Canonical e noindex
Una pagina non dovrebbe indicare ai motori di ricerca contemporaneamente di indicizzarla e di ignorarla. Silktide trova le pagine che inviano esattamente questa contraddizione, che di solito indica un errore nel modello.
Questo controllo si attiva quando una pagina presenta una direttiva e un autoreferenziale: un canonical la cui destinazione è la pagina stessa. Il canonical dice «questo è l'URL autorevole da indicizzare», mentre noindex dice «non indicizzare questa pagina»:
<!-- Contraddittorio: noindex più un canonical che punta alla pagina stessa -->
<meta name="robots" content="noindex">
<link rel="canonical" href="https:\/\/www.example.com\/thank-you">
Perché è importante
Questi due segnali indicano direzioni opposte e i motori di ricerca risolvono il conflitto in modo imprevedibile: potrebbero rispettare l'uno o l'altro. Nella pratica, questa combinazione indica quasi sempre che un modello applica un canonical predefinito a ogni pagina, mentre una regola separata aggiunge noindex alle pagine che devono rimanere private (pagine di ringraziamento, anteprime, strumenti interni), o viceversa.
Risolvere il conflitto rende esplicita la tua intenzione di indicizzazione: le pagine che vuoi nei risultati di ricerca vengono indicizzate e quelle che vuoi nascondere rimangono nascoste.
Come risolvere il problema
Decidi cosa vuoi effettivamente per la pagina, quindi rimuovi uno dei due segnali:
- Se la pagina deve comparire nei risultati di ricerca, rimuovi la direttiva noindex (controlla sia il meta tag robots sia l'intestazione di risposta
X-Robots-Tag). - Se la pagina deve rimanere esclusa dai risultati di ricerca, rimuovi il tag canonical oppure impedisci al modello di aggiungere un canonical autoreferenziale alle pagine noindex.
Come Silktide esegue questo controllo
- Rileva una direttiva noindex dal meta tag robots della pagina o dall'intestazione di risposta
X-Robots-Tag(la direttivanoneviene conteggiata, poiché implica noindex). - Cerca un
<link rel="canonical">la cui destinazione sia la pagina stessa. Gli URL vengono confrontati per host e percorso:www, lo schema, le barre finali e la stringa di query vengono ignorati. - Segnala la pagina quando entrambi sono presenti.
- A differenza della maggior parte dei controlli SEO, questo controllo viene eseguito intenzionalmente sulle pagine non indicizzabili: è proprio nelle pagine noindex che compare il conflitto.