Canoniek versus noindex
Een pagina mag zoekmachines niet tegelijk vertellen dat ze de pagina moeten indexeren en negeren. Silktide vindt pagina's die precies deze tegenstrijdigheid veroorzaken, wat meestal wijst op een fout in een template.
Dit controle wordt geactiveerd wanneer een pagina een -instructie en een zelfverwijzende heeft – een canonieke URL waarvan het doel dezelfde pagina is. De canonieke URL zegt "dit is de gezaghebbende URL om te indexeren", terwijl noindex zegt "indexeer deze pagina niet":
<!-- Tegenstrijdig: noindex plus een canonieke URL die naar dezezelfde pagina verwijst -->
<meta name="robots" content="noindex">
<link rel="canonical" href="https:\/\/www.example.com\/thank-you">
Waarom dit belangrijk is
Deze twee signalen wijzen in tegengestelde richtingen en zoekmachines lossen het conflict onvoorspelbaar op – ze kunnen een van beide volgen. In de praktijk betekent deze combinatie bijna altijd dat een -template standaard een canonieke URL aan elke pagina toevoegt, terwijl een afzonderlijke regel noindex toevoegt aan pagina's die privé moeten blijven (bedankpagina's, voorbeelden, interne hulpprogramma's), of andersom.
Door het conflict op te lossen, maak je je indexeringsintentie expliciet. Zo worden pagina's die je in zoekresultaten wilt tonen geïndexeerd en blijven pagina's die je verborgen wilt houden verborgen.
Zo los je het op
Bepaal wat je daadwerkelijk met de pagina wilt bereiken en verwijder vervolgens een van de twee signalen:
- Als de pagina in zoekresultaten moet verschijnen, verwijder je de noindex-instructie (controleer zowel de robots-metatag als de
X-Robots-Tag-antwoordheader). - Als de pagina uit zoekresultaten moet blijven, verwijder je de canonieke tag van de pagina of zorg je ervoor dat je template geen zelfverwijzende canonieke URL toevoegt aan noindex-pagina's.
Hoe Silktide dit controleert
- Detecteer een noindex-instructie in de robots-metatag of de
X-Robots-Tag-antwoordheader van de pagina (de instructienonetelt mee, omdat deze noindex impliceert). - Zoek naar een
<link rel="canonical">waarvan het doel de pagina zelf is. URL's worden vergeleken op basis van host en pad:www, het schema, afsluitende schuine strepen en de querystring worden genegeerd. - Markeer de pagina wanneer beide aanwezig zijn.
- In tegenstelling tot de meeste SEO-controles wordt deze controle bewust uitgevoerd op niet-indexeerbare pagina's – juist op noindex-pagina's doet dit conflict zich voor.