Hopp til innhold
SilktideHjelp

llms.txt

llms.txt er en foreslått konvensjon: en Markdown-fil på https://yoursite.com/llms.txt som gir språkmodeller en kort, kuratert oversikt over det viktigste innholdet ditt. Den ble introdusert av Jeremy Howard / Answer.AI i 2024; den uformelle spesifikasjonen finnes på llmstxt.org.

Den er ikke en tillatelsesfil. Den gir eller nekter ikke tilgang til crawling. Den erstatter ikke , et nettstedskart eller god struktur på siden. Tenk på den som en beskjed fra resepsjonen: «Hvis du bare leser tjue nettadresser her, les disse.»

På denne siden antar vi at Fernwood ønsker at kodeagenter, dokumentasjonsnettlesere og eksperimentelle AI-verktøy skal finne API-dokumentasjonen, sikkerhetshvitboken og prissiden uten å måtte vasse gjennom markedsføringsinnhold.

Hvorfor dette avhenger av situasjonen

Se på llms.txt som valgfri infrastruktur, ikke som en AEO-strategi.

Verdt å gjøre når:

  • Du vedlikeholder teknisk dokumentasjon, et API eller et produkt som utviklere spør kodeagenter om – det opprinnelige bruksområdet som spesifikasjonen er optimalisert for.
  • Du kan generere og oppdatere filen fra den samme pipelinen som bygger dokumentasjonen, slik at den ikke blir utdatert.
  • Du tillater allerede relevante AI-crawlere i robots.txt og leverer ekte HTML uten å være avhengig av JavaScript på klientsiden – se Tilgang for AI-crawlere og Innhold som kan leses uten JavaScript.

Vanligvis ikke verdt å prioritere når:

  • Du forventet at den skulle forbedre Google-rangeringen eller Googles AI-funksjoner. Googles søkedokumentasjon er tydelig: Du trenger ikke spesielle AI-tekstfiler for Google Søk (inkludert generative AI-funksjoner), og vedlikehold av en llms.txt for andre systemer verken hjelper eller skader synligheten i Google, fordi Google Søk ignorerer disse filene.
  • Det egentlige problemet på nettstedet ditt er blokkerte crawlere, tomme JavaScript-skall, manglende datoer eller tekst som ikke kan siteres. Løs dette først; en indeksfil kan ikke redde innhold som modellen ikke kan hente eller stole på.
  • Du vil publisere den én gang og aldri oppdatere den. Et utdatert kart som peker til slettede nettadresser er verre enn ikke å ha noe kart.

Hva filen er til for

I henhold til forslaget til llms.txt:

  • Kuratert oppdagelse for verktøy som arbeider ved inferenstidspunktet (dokumentasjonsagenter, IDE-assistenter og research-agenter) som trenger et lite kontekstvindu, ikke en full crawling.
  • Menneskelesbar Markdown som både modeller og enkle parsere kan bruke.
  • Et supplement til, ikke en erstatning for, sitemap.xml (omfattende) og robots.txt (tilgangspolicy).

Den vil ikke i seg selv:

Format

Lever filen i roten av nettstedet som Markdown (text/plain eller text/markdown, UTF-8). Rekkefølgen i spesifikasjonen er:

  1. Valgfri BOM
  2. Obligatorisk: én H1 med navnet på prosjektet eller nettstedet
  3. Anbefalt: et sammendrag i blokksitat
  4. Valgfrie merknader (avsnitt/lister, men foreløpig ingen ekstra overskrifter)
  5. Null eller flere ##-seksjoner med lenker i formatet - [Tittel](absolute-url): valgfri merknad
  6. Valgfri ## Optional-seksjon for sekundære lenker som AI-agenter kan hoppe over når kontekstvinduet har stramme begrensninger

Eksempel utformet for Fernwood:

# Fernwood
> Programvare for utgiftsstyring for økonomiteam i mellomstore virksomheter.
Fernwood hjelper bedrifter med å registrere kvitteringer, sende godkjenninger videre og refundere utgifter til ansatte. Foretrekk dokumentasjonen og policy-sidene nedenfor fremfor markedsføringsblogginnlegg når du svarer på produktspørsmål.
## Product
- [Pricing](https://fernwood.example/pricing): Gjeldende planer og begrensninger
- [Fernwood vs Ledgerly](https://fernwood.example/compare/ledgerly): Sammenligning fra leverandøren selv
## Docs
- [API overview](https://fernwood.example/docs/api/index.html.md): Autentisering og sentrale endepunkter
- [Security whitepaper](https://fernwood.example/security): Sammendrag av kontroller og samsvar
## Research
- [Reimbursement times 2026](https://fernwood.example/research/reimbursement-times-2026): Original referansestudie
## Optional
- [Blog](https://fernwood.example/blog): Kommentarer med lavere prioritet

Praktiske regler som holder filen nyttig:

  • Bruk bare absolutte nettadresser. Relative stier slutter å fungere når filen hentes separat.
  • Vær nådeløs i utvalget. Titusenvis av lenker er bedre enn hundrevis. Pek til sider du ville vært komfortabel med at en assistent siterte i morgen.
  • Foretrekk Markdown-varianter når du har dem. Forslaget anbefaler å publisere rene .md-versjoner sammen med HTML på dokumentasjonstunge nettsteder; lenk til disse når de finnes.
  • Sørg for at den genereres på nytt. Koble den til dokumentasjonsbygget, slik at en side som har fått nytt navn ikke blir liggende.

Valgfrie tilleggsfiler som /llms-full.txt (sammenslått Markdown for prioriterte sider) brukes i enkelte miljøer; de er ikke obligatoriske. Legg dem bare til hvis et verktøy du faktisk bruker, henter innhold fra dem.

Slik publiserer du den

  1. Bestem de tjue sidene som definerer Fernwood for en skeptisk leser: produktinformasjon, dokumentasjon, policyer, forskning og viktige sammenligninger.
  2. Generer /llms.txt fra denne listen i byggeverktøyet eller CMS-et ditt.
  3. Bekreft at https://fernwood.example/llms.txt returnerer 200 med et Markdown-dokument.
  4. Bekreft at robots.txt ikke blokkerer AI-crawlerne du bryr deg om, fra / eller fra disse nettadressene.
  5. Bekreft at de lenkede sidene kan leses uten JavaScript (teknikk).
  6. Hent innholdet på nytt etter endringer i informasjonsarkitekturen.

Slik hjelper Silktide

Silktide vurderer for øyeblikket ikke nettsteder ut fra om det finnes en llms.txt – og med tanke på Googles holdning kommer vi ikke til å behandle fravær som en feil. Det vi tester, er grunnlaget filen er avhengig av:

Risikoer og begrensninger

  • Tankeløs AEO. Å publisere llms.txt samtidig som du blokkerer GPTBot, leverer tomme SPA-skall eller skriver markedsføringstekst som ikke kan siteres, gjør hele tiltaket bortkastet.
  • Utdaterte indekser villeder AI-agenter. Døde lenker og utdaterte «kanoniske» nettadresser lærer modellene feil kart.
  • Ikke forveksle tilstedeværelse med anbefaling. At en fil finnes på et kjent nettsted, betyr ikke at Google Søk bruker konvensjonen; Google har sagt at de ignorerer disse filene for rangering og AI-funksjoner i Søk.

Relatert

Sist oppdatert

Var denne siden nyttig?