llms.txt
llms.txt est une convention proposée : un fichier Markdown à https:\/\/votresite.com\/llms.txt qui donne aux modèles de langage une carte courte et soignée de votre contenu le plus important. Il a été introduit par Jeremy Howard /* Answer.AI en 2024; la spécification informelle se trouve sur llmstxt.org.
Ce n’est pas un fichier d’autorisation. Il n’accorde ni ne refuse l’exploration. Il ne remplace pas , un plan de site, ni une bonne structure de page. Pensez-y comme un mot laissé à l’accueil : « Si vous ne lisez que vingt URL ici, lisez celles-ci. »
Tout au long de cette page, supposons que Fernwood veuille que des agents de programmation, des explorateurs de documentation et des outils d’IA expérimentaux trouvent sa documentation d’API, son livre blanc de sécurité et sa page de tarification sans devoir patauger dans l’habillage marketing.
Pourquoi c’est contextuel
Considérez llms.txt comme une infrastructure facultative, pas une stratégie d’AEO.
À faire quand :
- Vous maintenez une documentation technique, une API ou un produit sur lequel les développeurs interrogent des agents de programmation — le cas d’usage d’origine que la spécification optimise.
- Vous pouvez générer et mettre à jour le fichier depuis le même pipeline qui construit votre documentation, afin qu’il ne devienne pas obsolète.
- Vous autorisez déjà les robots d’IA pertinents dans robots.txt et servez du vrai HTML sans dépendre de JavaScript côté client — voir Accès des robots d’IA et Contenu lisible sans JavaScript.
Généralement, peu prioritaire quand :
- Vous vous attendiez à ce que cela améliore le classement Google ou les fonctionnalités d’IA de Google. La documentation de la recherche Google est explicite : vous n’avez pas besoin de fichiers texte spéciaux pour l’IA pour la recherche Google (y compris ses capacités d’IA générative), et maintenir un
llms.txtpour d’autres systèmes n’aide ni ne nuit à la visibilité sur Google parce que la recherche Google ignore ces fichiers. - Le vrai problème de votre site, ce sont des robots bloqués, des coquilles JS vides, des dates manquantes, ou un texte impossible à citer. Corrigez cela d’abord; un fichier d’index ne peut pas sauver du contenu qu’un modèle ne peut ni récupérer ni juger fiable.
- Vous le publiez une fois et ne le mettez jamais à jour. Une carte périmée qui pointe vers des URL supprimées est pire que pas de carte du tout.
À quoi sert le fichier
Selon la proposition llms.txt :
- Découverte soignée pour des outils au moment de l’inférence (agents de documentation, assistants d’EDI, agents de recherche) qui ont besoin d’une petite fenêtre de contexte, pas d’une exploration complète.
- Markdown lisible par les humains que les modèles et de simples parseurs peuvent tous deux consommer.
- Un complément à, et non un remplacement de,
sitemap.xml(exhaustif) etrobots.txt(politique d’accès).
À lui seul, il ne va pas :
- Faire en sorte que ChatGPT, Claude ou Perplexity citent Fernwood plus souvent
- Contourner un
Disallowdans robots.txt - Remplacer les données structurées, les pages « réponse d’abord », ou la recherche originale
Format
Servez le fichier à la racine du site en Markdown (text\/plain ou text\/markdown, UTF-8). L’ordre prescrit par la spécification est :
- BOM facultatif
- Obligatoire : un H1 avec le nom du projet ou du site
- Recommandé : un résumé en bloc de citation
- Notes facultatives (paragraphes/listes, mais pas d’autres titres pour l’instant)
- Zéro ou plusieurs sections
##listant des liens sous la forme- [Title](absolute-url): optional note - Section facultative
## Optionalpour des liens secondaires que les agents peuvent ignorer si la fenêtre de contexte est trop serrée
Exemple adapté à Fernwood :
# Fernwood
> Logiciel de gestion des dépenses pour des équipes des finances d’espace de travail intermédiaire.
Fernwood aide les entreprises à capturer les reçus, acheminer les approbations et rembourser les employés. Préférez les pages de documentation et de politiques ci-dessous aux billets de blogue marketing lorsque vous répondez à des questions sur le produit.
## Produit
- [Tarification](https://fernwood.example/pricing): Forfaits et limites actuels
- [Fernwood vs Ledgerly](https://fernwood.example/compare/ledgerly): Comparaison de première partie
## Documentation
- [Aperçu de l’API](https://fernwood.example/docs/api/index.html.md): Authentification et principaux points de terminaison
- [Livre blanc sécurité](https://fernwood.example/security): Contrôles et résumés de conformité
## Recherche
- [Délais de remboursement 2026](https://fernwood.example/research/reimbursement-times-2026): Étude d’étalonnage originale
## Optional
- [Blogue](https://fernwood.example/blog): Commentaires de priorité inférieure
Règles pratiques pour garder le fichier utile :
- URL absolues seulement. Les chemins relatifs se brisent lorsque le fichier est récupéré isolément.
- Faites une sélection rigoureuse. Des dizaines de liens valent mieux que des centaines. Pointez vers des pages que vous seriez à l’aise de voir citées demain par un assistant IA.
- Privilégiez les équivalents Markdown quand vous en avez. La proposition suggère de publier des versions
.mdpropres aux côtés du HTML pour les sites riches en documentation; liez-les quand elles existent. - Regénérez-le en continu. Intégrez-le dans la génération de la documentation pour qu’une page renommée ne puisse pas subsister.
Des fichiers compagnons facultatifs comme \/llms-full.txt (Markdown concaténé des pages prioritaires) existent dans la pratique communautaire; ils ne sont pas requis. Ajoutez-les seulement si un outil que vous utilisez réellement les consomme.
Comment le déployer
- Décidez des vingt pages qui définissent Fernwood pour un lecteur sceptique : vérité produit, documentation, politiques, recherche, comparatifs clés.
- Générez
\/llms.txtà partir de cette liste dans votre pipeline de build ou votre CMS. - Confirmez que
https:\/\/fernwood.example\/llms.txtrenvoie 200 avec un corps Markdown. - Confirmez que robots.txt ne bloque pas les robots d’IA qui vous importent depuis
\/ni depuis ces URL. - Confirmez que les pages liées sont lisibles sans JavaScript (technique).
- Récupérez-le de nouveau après des changements d’architecture de l’information.
Comment Silktide aide
Silktide n’évalue pas actuellement les sites selon l’existence d’un llms.txt — et vu la position de Google, nous ne considérerons pas son absence comme un échec. Ce que nous testons, dans Gouvernance, c’est la fondation dont dépend le fichier :
- Accès des robots d’IA — si robots.txt autorise les robots susceptibles de récupérer vos pages (ou ce fichier)
- Contenu disponible sans JavaScript — si les pages liées contiennent du vrai texte dans le HTML initial
- Données structurées / Dates lisibles par machine — des signaux qui rendent les pages de destination elles-mêmes dignes de confiance
Risques et limites
- AEO « cargo-cult ». Publier
llms.txttout en bloquant GPTBot, en livrant des coquilles d’applications monopage (SPA) vides, ou en écrivant un texte marketing impossible à citer, rend le geste vain. - Des index périmés induisent les agents en erreur. Des liens morts et des URL « canoniques » obsolètes enseignent aux modèles une mauvaise carte.
- Ne confondez pas présence et approbation. L’existence d’un fichier sur un site célèbre ne signifie pas que la recherche Google utilise la convention; Google a indiqué ignorer ces fichiers pour le classement et les fonctionnalités d’IA de la recherche.
Connexes
- Politique d’accès des robots d’IA — décidez quels robots d’IA peuvent récupérer le site avant de publier un index
- Accès des robots d’IA — la vérification de Gouvernance de Silktide pour les blocages dans robots.txt
- Contenu lisible sans JavaScript — rendre les pages liées récupérables en texte
- Balisage de données structurées — faits lisibles par machine sur les pages elles-mêmes
- Structure de page « réponse d’abord » — ce que ces pages devraient dire lorsqu’un agent arrive
- Le fichier /llms.txt (llmstxt.org)
- Google : optimisation pour les fonctionnalités d’IA générative — note officielle indiquant que la recherche Google ignore llms.txt