Canonique vs noindex
Une page ne devrait pas dire aux moteurs de recherche à la fois de l'indexer et de l'ignorer. Silktide repère les pages qui envoient exactement cette contradiction, ce qui signifie généralement une erreur de gabarit.
Ce contrôle se déclenche lorsqu'une page a une directive et une auto-référente - une canonique dont la cible est la même page. La canonique dit "c'est l'URL faisant autorité à indexer" tandis que noindex dit "n'indexez pas cette page" :
<!-- Contradictoire : noindex plus une canonique pointant vers cette même page -->
<meta name="robots" content="noindex">
<link rel="canonical" href="https://www.example.com/thank-you">
Pourquoi c'est important
Ces deux signaux tirent dans des directions opposées, et les moteurs de recherche résolvent le conflit de manière imprévisible - ils peuvent respecter l'un ou l'autre. En pratique, cette combinaison signifie presque toujours qu'un gabarit de applique une canonique par défaut à chaque page, tandis qu'une règle distincte ajoute noindex aux pages censées rester privées (pages de remerciement, aperçus, outils internes), ou l'inverse.
Résoudre le conflit rend votre intention d'indexation explicite, de sorte que les pages que vous voulez voir dans la recherche soient indexées et que celles que vous voulez cacher restent cachées.
Comment corriger
Décidez de ce que vous voulez réellement pour la page, puis supprimez l'un des deux signaux :
- Si la page doit apparaître dans la recherche, retirez la directive noindex (vérifiez à la fois la balise meta robots et l'en-tête de réponse
X-Robots-Tag). - Si la page doit rester hors de la recherche, retirez la balise canonique de celle-ci, ou empêchez votre gabarit d'ajouter une canonique auto-référente aux pages noindex.
Comment Silktide vérifie cela
- Détecter une directive noindex à partir de la balise meta robots de la page ou de l'en-tête de réponse
X-Robots-Tag(la directivenonecompte, car elle implique noindex). - Rechercher un
<link rel="canonical">dont la cible est la page elle-même. Les URL sont comparées par hôte et chemin :www, le protocole, les barres obliques finales et la chaîne de requête sont ignorés. - Signaler la page lorsque les deux sont présents.
- Contrairement à la plupart des vérifications SEO, celle-ci s'exécute délibérément sur des pages non indexables - les pages noindex sont précisément là où le conflit apparaît.