Passer au contenu
SilktideAide

llms.txt

llms.txt est une convention proposée : un fichier Markdown à https:\/\/votresite.com\/llms.txt qui donne aux modèles de langage une carte courte et soignée de votre contenu le plus important. Il a été introduit par Jeremy Howard /* Answer.AI en 2024; la spécification informelle se trouve sur llmstxt.org.

Ce n’est pas un fichier d’autorisation. Il n’accorde ni ne refuse l’exploration. Il ne remplace pas , un plan de site, ni une bonne structure de page. Pensez-y comme un mot laissé à l’accueil : « Si vous ne lisez que vingt URL ici, lisez celles-ci. »

Tout au long de cette page, supposons que Fernwood veuille que des agents de programmation, des explorateurs de documentation et des outils d’IA expérimentaux trouvent sa documentation d’API, son livre blanc de sécurité et sa page de tarification sans devoir patauger dans l’habillage marketing.

Pourquoi c’est contextuel

Considérez llms.txt comme une infrastructure facultative, pas une stratégie d’AEO.

À faire quand :

  • Vous maintenez une documentation technique, une API ou un produit sur lequel les développeurs interrogent des agents de programmation — le cas d’usage d’origine que la spécification optimise.
  • Vous pouvez générer et mettre à jour le fichier depuis le même pipeline qui construit votre documentation, afin qu’il ne devienne pas obsolète.
  • Vous autorisez déjà les robots d’IA pertinents dans robots.txt et servez du vrai HTML sans dépendre de JavaScript côté client — voir Accès des robots d’IA et Contenu lisible sans JavaScript.

Généralement, peu prioritaire quand :

  • Vous vous attendiez à ce que cela améliore le classement Google ou les fonctionnalités d’IA de Google. La documentation de la recherche Google est explicite : vous n’avez pas besoin de fichiers texte spéciaux pour l’IA pour la recherche Google (y compris ses capacités d’IA générative), et maintenir un llms.txt pour d’autres systèmes n’aide ni ne nuit à la visibilité sur Google parce que la recherche Google ignore ces fichiers.
  • Le vrai problème de votre site, ce sont des robots bloqués, des coquilles JS vides, des dates manquantes, ou un texte impossible à citer. Corrigez cela d’abord; un fichier d’index ne peut pas sauver du contenu qu’un modèle ne peut ni récupérer ni juger fiable.
  • Vous le publiez une fois et ne le mettez jamais à jour. Une carte périmée qui pointe vers des URL supprimées est pire que pas de carte du tout.

À quoi sert le fichier

Selon la proposition llms.txt :

  • Découverte soignée pour des outils au moment de l’inférence (agents de documentation, assistants d’EDI, agents de recherche) qui ont besoin d’une petite fenêtre de contexte, pas d’une exploration complète.
  • Markdown lisible par les humains que les modèles et de simples parseurs peuvent tous deux consommer.
  • Un complément à, et non un remplacement de, sitemap.xml (exhaustif) et robots.txt (politique d’accès).

À lui seul, il ne va pas :

Format

Servez le fichier à la racine du site en Markdown (text\/plain ou text\/markdown, UTF-8). L’ordre prescrit par la spécification est :

  1. BOM facultatif
  2. Obligatoire : un H1 avec le nom du projet ou du site
  3. Recommandé : un résumé en bloc de citation
  4. Notes facultatives (paragraphes/listes, mais pas d’autres titres pour l’instant)
  5. Zéro ou plusieurs sections ## listant des liens sous la forme - [Title](absolute-url): optional note
  6. Section facultative ## Optional pour des liens secondaires que les agents peuvent ignorer si la fenêtre de contexte est trop serrée

Exemple adapté à Fernwood :

# Fernwood
> Logiciel de gestion des dépenses pour des équipes des finances d’espace de travail intermédiaire.
Fernwood aide les entreprises à capturer les reçus, acheminer les approbations et rembourser les employés. Préférez les pages de documentation et de politiques ci-dessous aux billets de blogue marketing lorsque vous répondez à des questions sur le produit.
## Produit
- [Tarification](https://fernwood.example/pricing): Forfaits et limites actuels
- [Fernwood vs Ledgerly](https://fernwood.example/compare/ledgerly): Comparaison de première partie
## Documentation
- [Aperçu de l’API](https://fernwood.example/docs/api/index.html.md): Authentification et principaux points de terminaison
- [Livre blanc sécurité](https://fernwood.example/security): Contrôles et résumés de conformité
## Recherche
- [Délais de remboursement 2026](https://fernwood.example/research/reimbursement-times-2026): Étude d’étalonnage originale
## Optional
- [Blogue](https://fernwood.example/blog): Commentaires de priorité inférieure

Règles pratiques pour garder le fichier utile :

  • URL absolues seulement. Les chemins relatifs se brisent lorsque le fichier est récupéré isolément.
  • Faites une sélection rigoureuse. Des dizaines de liens valent mieux que des centaines. Pointez vers des pages que vous seriez à l’aise de voir citées demain par un assistant IA.
  • Privilégiez les équivalents Markdown quand vous en avez. La proposition suggère de publier des versions .md propres aux côtés du HTML pour les sites riches en documentation; liez-les quand elles existent.
  • Regénérez-le en continu. Intégrez-le dans la génération de la documentation pour qu’une page renommée ne puisse pas subsister.

Des fichiers compagnons facultatifs comme \/llms-full.txt (Markdown concaténé des pages prioritaires) existent dans la pratique communautaire; ils ne sont pas requis. Ajoutez-les seulement si un outil que vous utilisez réellement les consomme.

Comment le déployer

  1. Décidez des vingt pages qui définissent Fernwood pour un lecteur sceptique : vérité produit, documentation, politiques, recherche, comparatifs clés.
  2. Générez \/llms.txt à partir de cette liste dans votre pipeline de build ou votre CMS.
  3. Confirmez que https:\/\/fernwood.example\/llms.txt renvoie 200 avec un corps Markdown.
  4. Confirmez que robots.txt ne bloque pas les robots d’IA qui vous importent depuis \/ ni depuis ces URL.
  5. Confirmez que les pages liées sont lisibles sans JavaScript (technique).
  6. Récupérez-le de nouveau après des changements d’architecture de l’information.

Comment Silktide aide

Silktide n’évalue pas actuellement les sites selon l’existence d’un llms.txt — et vu la position de Google, nous ne considérerons pas son absence comme un échec. Ce que nous testons, dans Gouvernance, c’est la fondation dont dépend le fichier :

Risques et limites

  • AEO « cargo-cult ». Publier llms.txt tout en bloquant GPTBot, en livrant des coquilles d’applications monopage (SPA) vides, ou en écrivant un texte marketing impossible à citer, rend le geste vain.
  • Des index périmés induisent les agents en erreur. Des liens morts et des URL « canoniques » obsolètes enseignent aux modèles une mauvaise carte.
  • Ne confondez pas présence et approbation. L’existence d’un fichier sur un site célèbre ne signifie pas que la recherche Google utilise la convention; Google a indiqué ignorer ces fichiers pour le classement et les fonctionnalités d’IA de la recherche.

Connexes

Dernière mise à jour

Cette page vous a-t-elle été utile?

llms.txt | Aide de Silktide