llms.txt
llms.txt är en föreslagen konvention: en Markdown-fil på https://yoursite.com/llms.txt som ger språkmodeller en kort, kurerad karta över ditt viktigaste innehåll. Den introducerades av Jeremy Howard / Answer.AI 2024; den informella specifikationen finns på llmstxt.org.
Det är inte en behörighetsfil. Den ger eller nekar inte åtkomst för crawling. Den ersätter inte , en webbplatskarta eller en bra struktur på sidan. Se den som ett meddelande från en receptionist: ”Om du bara läser tjugo URL:er här, läs dessa.”
På den här sidan antar vi att Fernwood vill att kodningsagenter, dokumentationsläsare och experimentella AI-verktyg ska hitta företagets API-dokumentation, säkerhetsrapport och prissida utan att behöva ta sig igenom marknadsföringsmaterial.
Varför detta beror på situationen
Betrakta llms.txt som valfri infrastruktur, inte som en AEO-strategi.
Värt att göra när:
- Du underhåller teknisk dokumentation, ett API eller en produkt som utvecklare frågar AI-agenter om – det ursprungliga användningsområdet som specifikationen är optimerad för.
- Du kan generera och uppdatera filen från samma pipeline som bygger dokumentationen, så att den inte blir inaktuell.
- Du tillåter redan relevanta AI-crawlers i robots.txt och levererar riktig HTML utan att vara beroende av JavaScript på klientsidan – se Åtkomst för AI-crawlers och Innehåll som är läsbart utan JavaScript.
Vanligtvis inte värt att prioritera när:
- Du förväntar dig att den ska förbättra Googles rankning eller Googles AI-funktioner. Googles sökdokumentation är tydlig: du behöver inga särskilda AI-textfiler för Google Sök (inklusive generativa AI-funktioner), och att underhålla en
llms.txtför andra system varken hjälper eller skadar synligheten i Google, eftersom Google Sök ignorerar dessa filer. - Webbplatsens verkliga problem är blockerade crawlers, tomma JS-skal, saknade datum eller text som inte går att citera. Åtgärda det först; en indexfil kan inte rädda innehåll som modellen inte kan hämta eller lita på.
- Du skulle publicera den en gång och aldrig uppdatera den. En inaktuell karta som pekar på borttagna URL:er är sämre än ingen karta alls.
Vad filen är till för
Enligt förslaget till llms.txt är filen till för:
- Kurerad upptäckt för verktyg som arbetar vid inferenstillfället (dokumentationsagenter, IDE-assistenter, forskningsagenter) som behöver ett litet kontextfönster, inte en fullständig crawling.
- Människoläsbar Markdown som både modeller och enkla parsrar kan använda.
- Ett komplement till, inte en ersättning för,
sitemap.xml(uttömmande) ochrobots.txt(åtkomstpolicy).
Den kommer inte att på egen hand:
- Få ChatGPT, Claude eller Perplexity att oftare hänvisa till Fernwood
- Kringgå en
Disallowi robots.txt - Ersätta strukturerad data, sidor med svaret först eller originalforskning
Format
Publicera filen i webbplatsens rot som Markdown (text/plain eller text/markdown, UTF-8). Specifikationens ordning är:
- Valfri BOM
- Obligatoriskt: en H1-rubrik med projektets eller webbplatsens namn
- Rekommenderat: en sammanfattning i blockcitat
- Valfria anteckningar (stycken/listor, men ännu inga ytterligare rubriker)
- Noll eller fler
##-avsnitt med länkar i formatet- [Titel](absolut-url): valfri anteckning - Valfritt
## Optional-avsnitt för sekundära länkar som AI-agenter kan hoppa över när kontextgränserna är snäva
Exempel utformat för Fernwood:
# Fernwood
> Programvara för utgiftshantering för ekonomiavdelningar i medelstora företag.
Fernwood hjälper företag att samla in kvitton, skicka godkännanden vidare och ersätta medarbetare. Föredra dokumentations- och policysidorna nedan framför marknadsföringsinlägg i bloggen när du svarar på produktfrågor.
## Product
- [Priser](https://fernwood.example/pricing): Aktuella paket och begränsningar
- [Fernwood jämfört med Ledgerly](https://fernwood.example/compare/ledgerly): Jämförelse från företaget självt
## Docs
- [API-översikt](https://fernwood.example/docs/api/index.html.md): Autentisering och centrala slutpunkter
- [Säkerhetsrapport](https://fernwood.example/security): Sammanfattningar av kontroller och efterlevnad
## Research
- [Ersättningstider 2026](https://fernwood.example/research/reimbursement-times-2026): Originalstudie med benchmarkdata
## Optional
- [Blogg](https://fernwood.example/blog): Kommentarer med lägre prioritet
Praktiska regler som håller filen användbar:
- Endast absoluta URL:er. Relativa sökvägar fungerar inte när filen hämtas fristående.
- Kurera skoningslöst. Dussintals länkar är bättre än hundratals. Länka till sidor som du gärna skulle se att en AI-assistent citerade i morgon.
- Föredra Markdown-versioner när sådana finns. Förslaget rekommenderar att rena
.md-versioner publiceras parallellt med HTML på dokumentationstunga webbplatser; länka till dem när de finns. - Håll filen regenererad. Koppla den till dokumentationsbygget så att en sida som bytt namn inte ligger kvar.
Valfria kompletterande filer som /llms-full.txt (sammanfogad Markdown för prioriterade sidor) förekommer i communityn; de krävs inte. Lägg bara till dem om ett verktyg du faktiskt använder läser dem.
Så publicerar du den
- Bestäm de tjugo sidor som definierar Fernwood för en skeptisk läsare: produktfakta, dokumentation, policyer, forskning och viktiga jämförelser.
- Generera
/llms.txtfrån den listan i ditt bygge eller CMS. - Bekräfta att
https://fernwood.example/llms.txtreturnerar 200 med en Markdown-text. - Bekräfta att robots.txt inte blockerar de AI-crawlers du bryr dig om från
/eller från dessa URL:er. - Bekräfta att de länkade sidorna är läsbara utan JavaScript (teknik).
- Hämta filen igen efter ändringar i informationsarkitekturen.
Så hjälper Silktide till
Silktide poängsätter för närvarande inte webbplatser utifrån om en llms.txt finns – och med tanke på Googles ståndpunkt kommer vi inte att behandla frånvaron som ett fel. Det vi testar är grunden som filen är beroende av:
- Åtkomst för AI-crawlers – om robots.txt tillåter de crawlers som kan hämta dina sidor (eller den här filen)
- Innehåll tillgängligt utan JavaScript – om de länkade sidorna innehåller riktig text i den ursprungliga HTML-koden
- Strukturerad data / Maskinläsbara datum – signaler som gör målsidorna i sig tillförlitliga
Risker och begränsningar
- AEO enligt flockmentalitet. Att publicera
llms.txtsamtidigt som du blockerar GPTBot, levererar tomma SPA-skal eller skriver marknadsföringstext som inte går att citera gör gesten meningslös. - Inaktuella index vilseleder AI-agenter. Döda länkar och föråldrade ”kanoniska” URL:er lär modellerna fel karta.
- Förväxla inte förekomst med stöd. Att en fil finns på en välkänd webbplats betyder inte att Google Sök använder konventionen; Google har sagt att det ignorerar dessa filer för rankning och AI-sökfunktioner.
Relaterat
- Policy för åtkomst för AI-crawlers – bestäm vilka AI-botar som får hämta webbplatsen innan du publicerar ett index
- Åtkomst för AI-crawlers – Silktides kontroll av blockeringar i robots.txt
- Innehåll som är läsbart utan JavaScript – gör länkade sidor möjliga att hämta som text
- Markup för strukturerad data – maskinläsbara fakta på själva sidorna
- Sidstruktur med svaret först – vad sidorna bör säga när en AI-agent anländer
- Filen /llms.txt (llmstxt.org)
- Google: optimera för generativa AI-funktioner – officiell information om att Google Sök ignorerar llms.txt