Controllore di Indicizzabilità
Una pagina può essere perfettamente valida ma invisibile ai motori di ricerca perché un singolo tag dice “noindex” o robots.txt blocca il crawler. Incolla un URL e questo controllore valuta ogni segnale che Google utilizza, robots.txt, meta robots, intestazione X-Robots-Tag, obiettivo canonico, stato HTTP, e ti dice se la pagina è indicizzabile, perché e cosa cambiare se non lo è.
Come controllare l'indicizzabilità
-
1
Inserisci un URL
Il controllore recupera l'URL come farebbe Googlebot.
-
2
Risolve i reindirizzamenti
Una catena di salti 301/302 viene tracciata; l'URL finale è quello valutato.
-
3
Legge ogni segnale di indicizzabilità
Regole robots.txt, meta robots, X-Robots-Tag, canonico, codice di stato.
-
4
Verdetto e motivo
Indicizzabile / non indicizzabile / parziale, con il segnale esatto che ha causato il verdetto.
Segnali di indicizzabilità e la loro precedenza
Google valuta un insieme di segnali in un ordine specifico; un singolo negativo nella catena è sufficiente per bloccare l’indicizzazione.
Ordine di valutazione dei segnali
- Stato HTTP: richiesto 2xx. Le catene 3xx vengono seguite; 4xx e 5xx interrompono l’indicizzazione.
- robots.txt: se l’URL è vietato per Googlebot, la pagina non viene mai scansionata, il che significa che i tag noindex su di essa non vengono mai visti.
- Intestazione X-Robots-Tag:
noindexnelle intestazioni della risposta HTTP blocca l’indicizzazione. - Meta robots:
<meta name="robots" content="noindex">blocca l’indicizzazione. - Canonico: un canonico che punta altrove significa che Google indicizza quell’altro URL invece.
- Qualità del contenuto e rilevamento dei duplicati: Google può saltare l’indicizzazione anche senza direttive esplicite.
Errori comuni che questo rileva
| Problema | Causa |
|---|---|
| Intera sezione non indicizzata | Regola Disallow: in robots.txt |
| Pagina specifica non indicizzata | noindex nei meta robots |
| Indicizzata con URL errato | Il canonico punta da un’altra parte |
| Bloccata a 5xx | L’errore del server interrompe la scansione |
| Conflitto tra Disallow e noindex | Robots.txt blocca la scansione, il tag noindex non viene mai letto |
| Perdite di staging in produzione | X-Robots-Tag: noindex rimasto da un ambiente di test |
La trappola robots.txt + noindex
Se Disallow: un URL in robots.txt, Google non lo scansiona mai, quindi non vede mai alcun tag noindex. L’URL può comunque apparire nei risultati di ricerca come un’entrata “vuota” con solo l’URL e senza descrizione. Per rimuovere correttamente un URL dall’indice, consenti la scansione e utilizza noindex, quindi blocca la scansione solo dopo che Google lo ha deindicizzato.
Testare dalla prospettiva di Googlebot
Il controllore invia l’agente utente Googlebot, quindi eventuali trucchi lato server “i crawler vedono solo X” sono visibili. Verifica sempre gli URL di produzione, non quelli di staging.
Domande frequenti
Essere indicizzabile significa solo che non c’è un blocco tecnico; non garantisce l’indicizzazione. Google decide anche in base alla qualità percepita, contenuti duplicati e budget di scansione. Usa l’Ispezione URL di Search Console per una risposta definitiva da Google stesso.
Di solito solo meta robots (o X-Robots-Tag) è la risposta giusta. Robots.txt blocca la scansione; meta robots blocca l’indicizzazione. Per le pagine che non vuoi indicizzare, consenti la scansione in modo che Google possa leggere il tuo tag noindex.
Google valuta la destinazione finale di una catena di reindirizzamenti. Un 301 da A a B significa che Google indicizza infine B, non A. Il controllore simula questo risolvendo tutti i reindirizzamenti prima di valutare.
No. Le pagine che richiedono autenticazione non sono indicizzabili per definizione. Se hai bisogno di SEO per esse, considera una versione di anteprima pubblica.
Strumenti correlati
Controllore della lunghezza della meta descrizione
Misura una meta description in caratteri e pixel stimati, confronta riferimenti editoriali e osserva simulazioni desktop e mobile.
Verifica degli header di sicurezza HTTP
Incolla gli header di risposta HTTP e controlla HSTS, CSP, protezione dai frame, MIME, referrer e criteri cross-origin localmente.
Simulatore SERP di Google
Controlla un'anteprima approssimativa in stile Google con limiti di caratteri per mobile e desktop. La bozza resta in questa sessione del browser.
Validatore di sitemap XML
Controlla nel browser gli errori di sintassi, le posizioni mancanti, gli URL duplicati e i valori comuni di una sitemap XML.
Generatore di Tag Canonici
Genera un tag link rel=canonical valido per qualsiasi URL. Include la validazione dell'URL e gli errori comuni da evitare.
Controllore URL Canonico
Incolla l'HTML di una pagina e controlla il suo tag rel=canonical: è presente, è un URL assoluto valido, corrisponde all'URL della pagina?
Strumento disponibile in altre lingue
- Indexerbarhetskontroll [SV]
- Vérificateur d'indexabilité [FR]
- Indexerbaarheidscontrole [NL]
- เครื่องตรวจสอบความสามารถในการจัดทำดัชนี (Indexability Checker) [TH]
- Công cụ kiểm tra khả năng lập chỉ mục [VI]
- مدقق قابلية الفهرسة [AR]
- Pemeriksa Indeksabilitas [ID]
- Verificador de Indexabilidad [ES]
- インデックス可能性チェッカー [JA]
- 인덱스화 가능성 검사기 [KO]
- Indexierbarkeitsprüfer [DE]
- Sprawdzacz indeksowalności [PL]
- Verificador de Indexabilidade [PT]
- Инструмент проверки индексируемости [RU]
- İndekslenebilirlik Kontrolcüsü [TR]
- 可索引性检测器 [ZH]
- Indexability Checker [EN]