llms.txt
llms.txt er en foreslått konvensjon: en Markdown-fil på https://yoursite.com/llms.txt som gir språkmodeller en kort, kuratert oversikt over det viktigste innholdet ditt. Den ble introdusert av Jeremy Howard / Answer.AI i 2024; den uformelle spesifikasjonen finnes på llmstxt.org.
Den er ikke en tillatelsesfil. Den gir eller nekter ikke tilgang til crawling. Den erstatter ikke , et nettstedskart eller god struktur på siden. Tenk på den som en beskjed fra resepsjonen: «Hvis du bare leser tjue nettadresser her, les disse.»
På denne siden antar vi at Fernwood ønsker at kodeagenter, dokumentasjonsnettlesere og eksperimentelle AI-verktøy skal finne API-dokumentasjonen, sikkerhetshvitboken og prissiden uten å måtte vasse gjennom markedsføringsinnhold.
Hvorfor dette avhenger av situasjonen
Se på llms.txt som valgfri infrastruktur, ikke som en AEO-strategi.
Verdt å gjøre når:
- Du vedlikeholder teknisk dokumentasjon, et API eller et produkt som utviklere spør kodeagenter om – det opprinnelige bruksområdet som spesifikasjonen er optimalisert for.
- Du kan generere og oppdatere filen fra den samme pipelinen som bygger dokumentasjonen, slik at den ikke blir utdatert.
- Du tillater allerede relevante AI-crawlere i robots.txt og leverer ekte HTML uten å være avhengig av JavaScript på klientsiden – se Tilgang for AI-crawlere og Innhold som kan leses uten JavaScript.
Vanligvis ikke verdt å prioritere når:
- Du forventet at den skulle forbedre Google-rangeringen eller Googles AI-funksjoner. Googles søkedokumentasjon er tydelig: Du trenger ikke spesielle AI-tekstfiler for Google Søk (inkludert generative AI-funksjoner), og vedlikehold av en
llms.txtfor andre systemer verken hjelper eller skader synligheten i Google, fordi Google Søk ignorerer disse filene. - Det egentlige problemet på nettstedet ditt er blokkerte crawlere, tomme JavaScript-skall, manglende datoer eller tekst som ikke kan siteres. Løs dette først; en indeksfil kan ikke redde innhold som modellen ikke kan hente eller stole på.
- Du vil publisere den én gang og aldri oppdatere den. Et utdatert kart som peker til slettede nettadresser er verre enn ikke å ha noe kart.
Hva filen er til for
I henhold til forslaget til llms.txt:
- Kuratert oppdagelse for verktøy som arbeider ved inferenstidspunktet (dokumentasjonsagenter, IDE-assistenter og research-agenter) som trenger et lite kontekstvindu, ikke en full crawling.
- Menneskelesbar Markdown som både modeller og enkle parsere kan bruke.
- Et supplement til, ikke en erstatning for,
sitemap.xml(omfattende) ogrobots.txt(tilgangspolicy).
Den vil ikke i seg selv:
- Få ChatGPT, Claude eller Perplexity til å sitere Fernwood oftere
- Omgå en
Disallowi robots.txt - Erstatte strukturerte data, sider med svaret først eller original forskning
Format
Lever filen i roten av nettstedet som Markdown (text/plain eller text/markdown, UTF-8). Rekkefølgen i spesifikasjonen er:
- Valgfri BOM
- Obligatorisk: én H1 med navnet på prosjektet eller nettstedet
- Anbefalt: et sammendrag i blokksitat
- Valgfrie merknader (avsnitt/lister, men foreløpig ingen ekstra overskrifter)
- Null eller flere
##-seksjoner med lenker i formatet- [Tittel](absolute-url): valgfri merknad - Valgfri
## Optional-seksjon for sekundære lenker som AI-agenter kan hoppe over når kontekstvinduet har stramme begrensninger
Eksempel utformet for Fernwood:
# Fernwood
> Programvare for utgiftsstyring for økonomiteam i mellomstore virksomheter.
Fernwood hjelper bedrifter med å registrere kvitteringer, sende godkjenninger videre og refundere utgifter til ansatte. Foretrekk dokumentasjonen og policy-sidene nedenfor fremfor markedsføringsblogginnlegg når du svarer på produktspørsmål.
## Product
- [Pricing](https://fernwood.example/pricing): Gjeldende planer og begrensninger
- [Fernwood vs Ledgerly](https://fernwood.example/compare/ledgerly): Sammenligning fra leverandøren selv
## Docs
- [API overview](https://fernwood.example/docs/api/index.html.md): Autentisering og sentrale endepunkter
- [Security whitepaper](https://fernwood.example/security): Sammendrag av kontroller og samsvar
## Research
- [Reimbursement times 2026](https://fernwood.example/research/reimbursement-times-2026): Original referansestudie
## Optional
- [Blog](https://fernwood.example/blog): Kommentarer med lavere prioritet
Praktiske regler som holder filen nyttig:
- Bruk bare absolutte nettadresser. Relative stier slutter å fungere når filen hentes separat.
- Vær nådeløs i utvalget. Titusenvis av lenker er bedre enn hundrevis. Pek til sider du ville vært komfortabel med at en assistent siterte i morgen.
- Foretrekk Markdown-varianter når du har dem. Forslaget anbefaler å publisere rene
.md-versjoner sammen med HTML på dokumentasjonstunge nettsteder; lenk til disse når de finnes. - Sørg for at den genereres på nytt. Koble den til dokumentasjonsbygget, slik at en side som har fått nytt navn ikke blir liggende.
Valgfrie tilleggsfiler som /llms-full.txt (sammenslått Markdown for prioriterte sider) brukes i enkelte miljøer; de er ikke obligatoriske. Legg dem bare til hvis et verktøy du faktisk bruker, henter innhold fra dem.
Slik publiserer du den
- Bestem de tjue sidene som definerer Fernwood for en skeptisk leser: produktinformasjon, dokumentasjon, policyer, forskning og viktige sammenligninger.
- Generer
/llms.txtfra denne listen i byggeverktøyet eller CMS-et ditt. - Bekreft at
https://fernwood.example/llms.txtreturnerer 200 med et Markdown-dokument. - Bekreft at robots.txt ikke blokkerer AI-crawlerne du bryr deg om, fra
/eller fra disse nettadressene. - Bekreft at de lenkede sidene kan leses uten JavaScript (teknikk).
- Hent innholdet på nytt etter endringer i informasjonsarkitekturen.
Slik hjelper Silktide
Silktide vurderer for øyeblikket ikke nettsteder ut fra om det finnes en llms.txt – og med tanke på Googles holdning kommer vi ikke til å behandle fravær som en feil. Det vi tester, er grunnlaget filen er avhengig av:
- Tilgang for AI-crawlere – om robots.txt tillater crawlerne som kan hente sidene dine (eller denne filen)
- Innhold som er tilgjengelig uten JavaScript – om de lenkede sidene inneholder ekte tekst i den opprinnelige HTML-en
- Strukturerte data / Maskinlesbare datoer – signaler som gjør målsidene mer pålitelige
Risikoer og begrensninger
- Tankeløs AEO. Å publisere
llms.txtsamtidig som du blokkerer GPTBot, leverer tomme SPA-skall eller skriver markedsføringstekst som ikke kan siteres, gjør hele tiltaket bortkastet. - Utdaterte indekser villeder AI-agenter. Døde lenker og utdaterte «kanoniske» nettadresser lærer modellene feil kart.
- Ikke forveksle tilstedeværelse med anbefaling. At en fil finnes på et kjent nettsted, betyr ikke at Google Søk bruker konvensjonen; Google har sagt at de ignorerer disse filene for rangering og AI-funksjoner i Søk.
Relatert
- Policy for tilgang for AI-crawlere – bestem hvilke AI-roboter som kan hente nettstedet før du publiserer en indeks
- Tilgang for AI-crawlere – Silktide-kontrollen for blokkeringer i robots.txt
- Innhold som kan leses uten JavaScript – gjør det mulig å hente de lenkede sidene som tekst
- Strukturerte data – maskinlesbare fakta på selve sidene
- Sidestruktur med svaret først – hva sidene bør si når en AI-agent kommer inn
- Filen /llms.txt (llmstxt.org)
- Google: optimalisering for generative AI-funksjoner – offisiell merknad om at Google Søk ignorerer llms.txt