llms.txt
llms.txt est une convention proposée : un fichier Markdown à l'adresse https:\/\/yoursite.com\/llms.txt qui offre aux modèles de langage une carte courte et sélectionnée de vos contenus les plus importants. Il a été introduit par Jeremy Howard / Answer.AI en 2024 ; la spécification informelle est disponible sur llmstxt.org.
Ce n'est pas un fichier d'autorisation. Il n'accorde ni ne refuse l'exploration. Il ne remplace pas , un sitemap, ni une bonne structure de page. Voyez-le comme une note de réception : « Si vous ne lisez que vingt URL ici, lisez celles-ci. »
Tout au long de cette page, supposons que Fernwood souhaite que des agents IA de programmation, des navigateurs de documentation et des outils d'IA expérimentaux trouvent sa documentation d'API, son livre blanc sécurité et sa page de tarifs sans patauger dans l'habillage marketing.
Pourquoi c'est contextuel
Considérez llms.txt comme une infrastructure optionnelle, pas comme une stratégie AEO.
À faire quand :
- Vous maintenez de la documentation technique, une API, ou un produit sur lequel les développeurs interrogent des agents IA de programmation — le cas d'usage d'origine que la spécification optimise.
- Vous pouvez générer et mettre à jour le fichier depuis le même pipeline qui construit votre documentation, afin qu'il ne pourrisse pas.
- Vous autorisez déjà les robots d'IA concernés dans robots.txt et servez du vrai HTML sans dépendre du JavaScript côté client — voir Accès des robots d'IA et Contenu lisible sans JavaScript.
Généralement pas prioritaire lorsque :
- Vous vous attendiez à ce que cela fasse bouger les classements Google ou les fonctionnalités d'IA de Google. La documentation de la recherche Google est explicite : vous n'avez pas besoin de fichiers texte spéciaux pour l'IA dans Google Search (y compris ses capacités d'IA générative), et maintenir un
llms.txtpour d'autres systèmes n'améliore ni ne détériore la visibilité Google car Google Search ignore ces fichiers. - Le vrai problème de votre site est l'accès bloqué des robots, des coques JS vides, des dates manquantes, ou un texte marketing impossible à citer. Corrigez cela d'abord ; un fichier d'index ne peut pas sauver un contenu qu'un modèle ne peut ni récupérer ni juger fiable.
- Vous le publieriez une fois et ne le mettriez jamais à jour. Une carte périmée qui pointe vers des URL supprimées est pire que pas de carte du tout.
À quoi sert ce fichier
Selon la proposition llms.txt :
- Découverte sélectionnée pour des outils à l'inférence (agents IA de documentation, assistants IA d'IDE, agents IA de recherche) qui ont besoin d'une petite fenêtre de contexte, pas d'un crawl complet.
- Markdown lisible par l'humain et consommable à la fois par les modèles et par de simples parseurs.
- Un complément à, et non un substitut à,
sitemap.xml(exhaustif) etrobots.txt(politique d'accès).
À lui seul, il ne va pas :
- Amener ChatGPT, Claude ou Perplexity à citer Fernwood plus souvent
- Contourner un
Disallowdans robots.txt - Se substituer au balisage de données structurées, aux pages « réponse d'abord », ou à la recherche originale
Format
Servez le fichier à la racine du site en Markdown (text\/plain ou text\/markdown, UTF-8). L'ordre de la spécification est :
- BOM facultatif
- Obligatoire : un H1 avec le nom du projet ou du site
- Recommandé : un résumé sous forme de bloc de citation
- Notes optionnelles (paragraphes/listes, mais pas de titres supplémentaires pour l'instant)
- Zéro ou plusieurs sections
##listant des liens sous la forme- [Title](absolute-url): optional note - Section optionnelle
## Optionalpour les liens secondaires que des agents IA peuvent ignorer sous de fortes contraintes de contexte
Exemple adapté à Fernwood :
# Fernwood
> Logiciel de gestion des notes de frais pour les équipes financières d'espaces de travail de taille moyenne.
Fernwood aide les entreprises à capturer les reçus, acheminer les validations et rembourser les employés. Préférez les pages de documentation et de politique ci-dessous aux articles de blog marketing pour répondre aux questions produit.
## Produit
- [Tarifs](https://fernwood.example/pricing): Offres et limites actuelles
- [Fernwood vs Ledgerly](https://fernwood.example/compare/ledgerly): Comparaison officielle (première main)
## Documentation
- [Présentation de l'API](https://fernwood.example/docs/api/index.html.md): Authentification et points de terminaison principaux
- [Livre blanc sécurité](https://fernwood.example/security): Contrôles et résumés de conformité
## Recherche
- [Délais de remboursement 2026](https://fernwood.example/research/reimbursement-times-2026): Étude de référence originale
## Optionnel
- [Blog](https://fernwood.example/blog): Commentaire de priorité inférieure
Règles pratiques qui maintiennent l'utilité du fichier :
- Uniquement des URL absolues. Les chemins relatifs cassent lorsque le fichier est récupéré isolément.
- Faites une sélection impitoyable. Des dizaines de liens valent mieux que des centaines. Pointez vers des pages que vous seriez heureux de voir citées demain par un assistant IA.
- Préférez les équivalents Markdown quand vous en avez. La proposition suggère de publier des versions
.mdpropres aux côtés du HTML pour les sites riches en documentation ; liez-les lorsqu'elles existent. - Maintenez la régénération. Intégrez-le au build de la documentation pour qu'une page renommée ne puisse pas rester en place.
Des fichiers compagnons optionnels comme \/llms-full.txt (Markdown concaténé des pages prioritaires) apparaissent dans la pratique communautaire ; ils ne sont pas requis. Ajoutez-les uniquement si un outil que vous utilisez réellement les consomme.
Comment le déployer
- Décidez des vingt pages qui définissent Fernwood pour un lecteur sceptique : vérité produit, documentation, politiques, recherche, comparaisons clés.
- Générez
\/llms.txtà partir de cette liste dans votre build ou votre CMS. - Vérifiez que
https:\/\/fernwood.example\/llms.txtrenvoie 200 avec un corps Markdown. - Vérifiez que robots.txt ne bloque pas les robots d'IA qui vous importent depuis
\/ou depuis ces URL. - Vérifiez que les pages liées sont lisibles sans JavaScript (technique).
- Re-téléchargez après des changements d'architecture de l'information.
Comment Silktide aide
Silktide n'attribue pas actuellement de score aux sites selon l'existence d'un llms.txt — et vu la position de Google, nous ne traiterons pas son absence comme un échec. En revanche, nous testons les fondations dont dépend ce fichier :
- Accès des robots d'IA — si robots.txt autorise les crawlers susceptibles de récupérer vos pages (ou ce fichier)
- Contenu disponible sans JavaScript — si les pages liées contiennent du vrai texte dans le HTML initial
- Données structurées / Dates lisibles par machine — des signaux qui rendent les pages de destination elles-mêmes fiables
Risques et limites
- AEO façon culte du cargo. Publier
llms.txttout en bloquant GPTBot, en livrant des coques de SPA vides, ou en écrivant un texte marketing impossible à citer, gâche le geste. - Des index périmés induisent les agents IA en erreur. Des liens morts et des URL « canoniques » obsolètes apprennent aux modèles une mauvaise carte.
- Ne confondez pas présence et approbation. L'existence d'un fichier sur un site célèbre ne signifie pas que Google Search utilise la convention ; Google a indiqué ignorer ces fichiers pour le classement et les fonctionnalités d'IA Search.
Connexes
- Politique d'accès des robots d'IA — décider quels robots d'IA peuvent récupérer le site avant de publier un index
- Accès des robots d'IA — la vérification Silktide des blocages dans robots.txt
- Contenu lisible sans JavaScript — rendre les pages liées récupérables en texte
- Balisage de données structurées — faits lisibles par machine sur les pages elles-mêmes
- Structure de page « réponse d'abord » — ce que ces pages devraient dire lorsqu'un agent IA arrive
- Le fichier /llms.txt (llmstxt.org)
- Google : optimiser pour les fonctionnalités d'IA générative — note officielle indiquant que Google Search ignore llms.txt