Noindex
Noindex est une instruction qui indique aux moteurs de recherche de ne pas inclure une page dans leurs résultats. Elle se définit à l'aide d'une balise meta robots dans le HTML de la page, ou avec un de réponse X-Robots-Tag :
<meta name="robots" content="noindex">
Une page en noindex peut toujours être consultée normalement ; elle n'apparaît simplement jamais dans la recherche. Cela rend un noindex accidentel facile à manquer : la page semble correcte, mais personne ne peut la trouver via un moteur de recherche. La directive none équivaut à noindex, nofollow.
Noindex ne fonctionne que si le robot d'exploration peut effectivement accéder à la page : si interdit aussi l'URL, le robot ne la récupère jamais, ne voit donc pas la balise noindex, et la page peut quand même être indexée — généralement sans extrait, uniquement l'URL. Pour tenir une page hors de la recherche de manière fiable, autorisez l'exploration et fiez-vous uniquement à noindex.
En savoir plus
- Bloquer l'indexation de la recherche avec noindex - Consignes de Google sur noindex