Aller au contenu
SilktideAide

llms.txt

llms.txt est une convention proposée : un fichier Markdown à l'adresse https:\/\/yoursite.com\/llms.txt qui offre aux modèles de langage une carte courte et sélectionnée de vos contenus les plus importants. Il a été introduit par Jeremy Howard / Answer.AI en 2024 ; la spécification informelle est disponible sur llmstxt.org.

Ce n'est pas un fichier d'autorisation. Il n'accorde ni ne refuse l'exploration. Il ne remplace pas , un sitemap, ni une bonne structure de page. Voyez-le comme une note de réception : « Si vous ne lisez que vingt URL ici, lisez celles-ci. »

Tout au long de cette page, supposons que Fernwood souhaite que des agents IA de programmation, des navigateurs de documentation et des outils d'IA expérimentaux trouvent sa documentation d'API, son livre blanc sécurité et sa page de tarifs sans patauger dans l'habillage marketing.

Pourquoi c'est contextuel

Considérez llms.txt comme une infrastructure optionnelle, pas comme une stratégie AEO.

À faire quand :

  • Vous maintenez de la documentation technique, une API, ou un produit sur lequel les développeurs interrogent des agents IA de programmation — le cas d'usage d'origine que la spécification optimise.
  • Vous pouvez générer et mettre à jour le fichier depuis le même pipeline qui construit votre documentation, afin qu'il ne pourrisse pas.
  • Vous autorisez déjà les robots d'IA concernés dans robots.txt et servez du vrai HTML sans dépendre du JavaScript côté client — voir Accès des robots d'IA et Contenu lisible sans JavaScript.

Généralement pas prioritaire lorsque :

  • Vous vous attendiez à ce que cela fasse bouger les classements Google ou les fonctionnalités d'IA de Google. La documentation de la recherche Google est explicite : vous n'avez pas besoin de fichiers texte spéciaux pour l'IA dans Google Search (y compris ses capacités d'IA générative), et maintenir un llms.txt pour d'autres systèmes n'améliore ni ne détériore la visibilité Google car Google Search ignore ces fichiers.
  • Le vrai problème de votre site est l'accès bloqué des robots, des coques JS vides, des dates manquantes, ou un texte marketing impossible à citer. Corrigez cela d'abord ; un fichier d'index ne peut pas sauver un contenu qu'un modèle ne peut ni récupérer ni juger fiable.
  • Vous le publieriez une fois et ne le mettriez jamais à jour. Une carte périmée qui pointe vers des URL supprimées est pire que pas de carte du tout.

À quoi sert ce fichier

Selon la proposition llms.txt :

  • Découverte sélectionnée pour des outils à l'inférence (agents IA de documentation, assistants IA d'IDE, agents IA de recherche) qui ont besoin d'une petite fenêtre de contexte, pas d'un crawl complet.
  • Markdown lisible par l'humain et consommable à la fois par les modèles et par de simples parseurs.
  • Un complément à, et non un substitut à, sitemap.xml (exhaustif) et robots.txt (politique d'accès).

À lui seul, il ne va pas :

Format

Servez le fichier à la racine du site en Markdown (text\/plain ou text\/markdown, UTF-8). L'ordre de la spécification est :

  1. BOM facultatif
  2. Obligatoire : un H1 avec le nom du projet ou du site
  3. Recommandé : un résumé sous forme de bloc de citation
  4. Notes optionnelles (paragraphes/listes, mais pas de titres supplémentaires pour l'instant)
  5. Zéro ou plusieurs sections ## listant des liens sous la forme - [Title](absolute-url): optional note
  6. Section optionnelle ## Optional pour les liens secondaires que des agents IA peuvent ignorer sous de fortes contraintes de contexte

Exemple adapté à Fernwood :

# Fernwood
> Logiciel de gestion des notes de frais pour les équipes financières d'espaces de travail de taille moyenne.
Fernwood aide les entreprises à capturer les reçus, acheminer les validations et rembourser les employés. Préférez les pages de documentation et de politique ci-dessous aux articles de blog marketing pour répondre aux questions produit.
## Produit
- [Tarifs](https://fernwood.example/pricing): Offres et limites actuelles
- [Fernwood vs Ledgerly](https://fernwood.example/compare/ledgerly): Comparaison officielle (première main)
## Documentation
- [Présentation de l'API](https://fernwood.example/docs/api/index.html.md): Authentification et points de terminaison principaux
- [Livre blanc sécurité](https://fernwood.example/security): Contrôles et résumés de conformité
## Recherche
- [Délais de remboursement 2026](https://fernwood.example/research/reimbursement-times-2026): Étude de référence originale
## Optionnel
- [Blog](https://fernwood.example/blog): Commentaire de priorité inférieure

Règles pratiques qui maintiennent l'utilité du fichier :

  • Uniquement des URL absolues. Les chemins relatifs cassent lorsque le fichier est récupéré isolément.
  • Faites une sélection impitoyable. Des dizaines de liens valent mieux que des centaines. Pointez vers des pages que vous seriez heureux de voir citées demain par un assistant IA.
  • Préférez les équivalents Markdown quand vous en avez. La proposition suggère de publier des versions .md propres aux côtés du HTML pour les sites riches en documentation ; liez-les lorsqu'elles existent.
  • Maintenez la régénération. Intégrez-le au build de la documentation pour qu'une page renommée ne puisse pas rester en place.

Des fichiers compagnons optionnels comme \/llms-full.txt (Markdown concaténé des pages prioritaires) apparaissent dans la pratique communautaire ; ils ne sont pas requis. Ajoutez-les uniquement si un outil que vous utilisez réellement les consomme.

Comment le déployer

  1. Décidez des vingt pages qui définissent Fernwood pour un lecteur sceptique : vérité produit, documentation, politiques, recherche, comparaisons clés.
  2. Générez \/llms.txt à partir de cette liste dans votre build ou votre CMS.
  3. Vérifiez que https:\/\/fernwood.example\/llms.txt renvoie 200 avec un corps Markdown.
  4. Vérifiez que robots.txt ne bloque pas les robots d'IA qui vous importent depuis \/ ou depuis ces URL.
  5. Vérifiez que les pages liées sont lisibles sans JavaScript (technique).
  6. Re-téléchargez après des changements d'architecture de l'information.

Comment Silktide aide

Silktide n'attribue pas actuellement de score aux sites selon l'existence d'un llms.txt — et vu la position de Google, nous ne traiterons pas son absence comme un échec. En revanche, nous testons les fondations dont dépend ce fichier :

Risques et limites

  • AEO façon culte du cargo. Publier llms.txt tout en bloquant GPTBot, en livrant des coques de SPA vides, ou en écrivant un texte marketing impossible à citer, gâche le geste.
  • Des index périmés induisent les agents IA en erreur. Des liens morts et des URL « canoniques » obsolètes apprennent aux modèles une mauvaise carte.
  • Ne confondez pas présence et approbation. L'existence d'un fichier sur un site célèbre ne signifie pas que Google Search utilise la convention ; Google a indiqué ignorer ces fichiers pour le classement et les fonctionnalités d'IA Search.

Connexes

Dernière mise à jour

Cette page vous a-t-elle été utile ?