Estrattore di Link Esterni

Incolla HTML grezzo e ottieni un elenco pulito e senza duplicati di ogni link esterno che contiene. Facoltativamente, inserisci un URL di base così l’estrattore sa quale host conta come interno; vengono segnalati i link verso qualsiasi altro host. Utile quando esegui un audit di un sito per perdite di link, posizionamenti di partner obsoleti o per verificare che i link in uscita vadano dove la tua politica prevede.

Come estrarre link esterni

  1. 1

    Fornisci la sorgente

    Incolla l'HTML grezzo della pagina. Facoltativamente, aggiungi un URL di base così l'estrattore sa quale host conta come interno; lascialo vuoto per trattare ogni host come esterno.

  2. 2

    Esegui l'estrazione

    Viene letto ogni `<a href>` e vengono conservati solo i link assoluti http/https il cui host differisce dall'host di base. I duplicati vengono rimossi.

  3. 3

    Esamina l'elenco

    Ottieni un URL esterno per riga, pronto da incollare in un foglio di calcolo o da controllare singolarmente.

  4. 4

    Usa il risultato

    Copia l'elenco negli appunti oppure tieni la pagina aperta mentre controlli ogni destinazione in una nuova scheda.

Cosa considera esterno l'estrattore

Un link è esterno quando il suo host differisce dall’URL di base fornito (il confronto non distingue tra maiuscole e minuscole). I sottodomini contano come host separati, quindi blog.example.com è esterno rispetto a www.example.com. Per audit su tutto il sottodominio, rimuovi il sottodominio dall’URL di base. Lascia vuoto l’URL di base per elencare ogni link http/https come esterno.

L’estrattore segnala solo gli URL di destinazione. Non legge il testo di ancoraggio né gli attributi rel; controlla quindi i token nofollow, ugc e sponsored direttamente nell’HTML sorgente.

Cosa ignora

  • mailto:, tel:, javascript: e href solo frammento #.
  • URL relative e URL relative al protocollo come //cdn.example.com (trasformale in URL assolute nell’HTML incollato se vuoi contarli).
  • Tag di ancoraggio senza href (non sono link navigabili).

Suggerimenti

  • Incolla l’HTML renderizzato se la pagina usa JavaScript. I link che un framework genera lato client compaiono solo quando incolli il DOM renderizzato (ad esempio copiando outerHTML da DevTools).
  • Attenzione ai wrapper di tracciamento. I reindirizzamenti affiliati tramite /go/ o /out/ possono nascondere la destinazione reale; l’estrattore restituisce l’URL del wrapper così com’è, quindi controlla l’href grezzo quando una destinazione sembra sospetta.
  • Normalizza prima di confrontare. Un URL con frammento o parametro di tracciamento diverso conta come un link separato; normalizza gli URL prima di confrontare due esecuzioni dell’estrattore.
  • Confronta nel tempo. Esegui l’estrattore ogni mese e confronta gli elenchi; nuovi link esterni che non hai aggiunto sono il primo segno di un tema o plugin compromesso.

Domande frequenti

Estrae l’href esattamente come scritto nell’HTML. Seguire ogni reindirizzamento rallenterebbe notevolmente il rapporto e potrebbe attivare le protezioni anti-bot sulla destinazione; risolvili separatamente se hai bisogno dell’URL finale.

No. L’estrattore analizza l’HTML così come viene fornito. I link che un framework rende lato client appariranno solo se incolli il DOM renderizzato (ad esempio copiando outerHTML da DevTools).

Vengono segnalati solo URL assoluti http/https. Gli URL relativi al protocollo come //cdn.example.com, i percorsi relativi e i link mailto: o tel: vengono saltati; trasformali in URL assolute nell’HTML incollato se vuoi contarli.

L’HTML che incolli viene inviato al nostro server solo per eseguire l’estrazione nella richiesta corrente. Non viene salvato in un database né in un log e nulla viene conservato dopo che la risposta raggiunge il tuo browser.

Strumenti correlati

Strumento disponibile in altre lingue