llms.txt
llms.txt è una convenzione proposta: un file Markdown disponibile all'indirizzo https:\/\/yoursite.com\/llms.txt che fornisce ai modelli linguistici una mappa breve e curata dei contenuti più importanti. È stato introdotto da Jeremy Howard di Answer.AI nel 2024; la specifica informale è disponibile su llmstxt.org.
Non è un file di autorizzazione. Non concede né nega l'accesso per la scansione. Non sostituisce , una sitemap o una buona struttura delle pagine. Pensalo come una nota per la reception: "Se qui leggi solo venti URL, leggi questi."
In questa pagina, supponiamo che Fernwood voglia consentire ad agenti di programmazione, browser di documentazione e strumenti di IA sperimentali di trovare la documentazione API, il white paper sulla sicurezza e la pagina dei prezzi senza dover attraversare elementi di marketing superflui.
Perché è una soluzione situazionale
Considera llms.txt un'infrastruttura facoltativa, non una strategia AEO.
Vale la pena implementarlo quando:
- Gestisci documentazione tecnica, un'API o un prodotto su cui gli sviluppatori pongono domande agli agenti di programmazione: il caso d'uso originale su cui si concentra la specifica.
- Puoi generare e aggiornare il file dalla stessa pipeline che crea la documentazione, così non diventa obsoleto.
- Consenti già ai crawler di IA pertinenti l'accesso in robots.txt e fornisci HTML reale senza dipendere da JavaScript lato client: consulta Accesso dei crawler di IA e Contenuti leggibili senza JavaScript.
Di solito non vale la pena dargli priorità quando:
- Ti aspetti che migliori il posizionamento su Google o le funzionalità di IA di Google. La documentazione della Ricerca Google è esplicita: per la Ricerca Google (incluse le sue funzionalità di IA generativa) non servono file di testo speciali per l'IA e mantenere un file
llms.txtper altri sistemi non aiuta né danneggia la visibilità su Google, perché la Ricerca Google ignora questi file. - Il vero problema del tuo sito riguarda crawler bloccati, shell JavaScript vuote, date mancanti o testi non citabili. Risolvi prima questi problemi: un file indice non può salvare contenuti che il modello non riesce a recuperare o di cui non può fidarsi.
- Pubblichi il file una volta sola e non lo aggiorni mai. Una mappa obsoleta che rimanda a URL eliminati è peggiore dell'assenza di una mappa.
A cosa serve il file
Secondo la proposta llms.txt:
- Scoperta curata per gli strumenti utilizzati al momento dell'inferenza (agenti per la documentazione, assistenti per IDE, agenti di ricerca) che necessitano di una finestra di contesto ridotta, non di una scansione completa.
- Markdown leggibile dalle persone che può essere utilizzato sia dai modelli sia dai parser semplici.
- Un complemento a, non un sostituto di,
sitemap.xml(esaustiva) erobots.txt(criteri di accesso).
Di per sé non può:
- Fare in modo che ChatGPT, Claude o Perplexity citino Fernwood più spesso
- Eludere una direttiva
Disallowin robots.txt - Sostituire i dati strutturati, le pagine con la risposta prima o la ricerca originale
Formato
Pubblica il file nella radice del sito come Markdown (text\/plain o text\/markdown, UTF-8). L'ordine previsto dalla specifica è:
- BOM facoltativo
- Obbligatorio: un solo H1 con il nome del progetto o del sito
- Consigliato: un riepilogo in un blocco di citazione
- Note facoltative (paragrafi/elenchi, ma per ora senza ulteriori titoli)
- Zero o più sezioni
##con link nel formato- [Titolo](absolute-url): nota facoltativa - Sezione
## Optionalfacoltativa per link secondari che gli agenti possono ignorare quando i limiti della finestra di contesto sono ridotti
Esempio con Fernwood:
# Fernwood
> Software per la gestione delle spese per i team finanziari di aziende di medie dimensioni.
Fernwood aiuta le aziende a raccogliere le ricevute, indirizzare le approvazioni e rimborsare i dipendenti. Quando rispondi a domande sul prodotto, preferisci la documentazione e le pagine relative alle policy riportate di seguito ai post del blog di marketing.
## Prodotto
- [Prezzi](https:\/\/fernwood.example\/pricing): Piani e limiti attuali
- [Fernwood e Ledgerly a confronto](https:\/\/fernwood.example\/compare\/ledgerly): Confronto di prima parte
## Documentazione
- [Panoramica dell'API](https:\/\/fernwood.example\/docs\/api\/index.html.md): Autenticazione ed endpoint principali
- [White paper sulla sicurezza](https:\/\/fernwood.example\/security): Riepiloghi dei controlli e della conformità
## Ricerca
- [Tempi di rimborso 2026](https:\/\/fernwood.example\/research\/reimbursement-times-2026): Studio di benchmark originale
## Optional
- [Blog](https:\/\/fernwood.example\/blog): Commenti a priorità inferiore
Regole pratiche per mantenere utile il file:
- Solo URL assoluti. I percorsi relativi si interrompono quando il file viene recuperato separatamente.
- Seleziona con rigore. Decine di link sono meglio di centinaia. Rimanda a pagine che saresti contento di vedere citate da un assistente domani.
- Preferisci i documenti Markdown associati quando disponibili. La proposta suggerisce di pubblicare versioni
.mdpulite insieme all'HTML per i siti con molta documentazione; collegale quando esistono. - Rigenera il file. Integralo nella build della documentazione, così una pagina rinominata non rimane nel file.
Nella pratica della community compaiono file associati facoltativi come \/llms-full.txt (Markdown concatenato delle pagine prioritarie); non sono obbligatori. Aggiungili solo se vengono utilizzati da uno strumento che usi effettivamente.
Come pubblicarlo
- Decidi le venti pagine che definiscono Fernwood per un lettore scettico: informazioni sul prodotto, documentazione, policy, ricerca e confronti importanti.
- Genera
\/llms.txtda quell'elenco nella build o nel CMS. - Verifica che
https:\/\/fernwood.example\/llms.txtrestituisca 200 con un corpo Markdown. - Verifica che robots.txt non blocchi i crawler di IA che ti interessano dalla radice
\/o da quegli URL. - Verifica che le pagine collegate siano leggibili senza JavaScript (tecnica).
- Esegui nuovamente il recupero dopo le modifiche all'architettura delle informazioni.
Come aiuta Silktide
Attualmente Silktide non valuta i siti in base alla presenza di llms.txt e, considerata la posizione di Google, non considereremo la sua assenza una carenza. Verifichiamo invece le fondamenta da cui dipende il file:
- Accesso dei crawler di IA: se robots.txt consente l'accesso ai crawler che potrebbero recuperare le tue pagine (o questo file)
- Contenuti disponibili senza JavaScript: se le pagine collegate contengono testo reale nell'HTML iniziale
- Dati strutturati / Date leggibili dalle macchine: segnali che rendono affidabili le pagine di destinazione
Rischi e limiti
- AEO fatto per imitazione. Pubblicare
llms.txtmentre blocchi GPTBot, distribuisci shell SPA vuote o scrivi testi di marketing non citabili vanifica l'iniziativa. - Gli indici obsoleti inducono in errore gli agenti. Link non più attivi e URL "canonici" non aggiornati insegnano ai modelli una mappa sbagliata.
- Non confondere la presenza con l'approvazione. Il fatto che un file esista su un sito famoso non significa che la Ricerca Google utilizzi la convenzione; Google ha dichiarato di ignorare questi file per il posizionamento e le funzionalità di Ricerca basate sull'IA.
Contenuti correlati
- Policy di accesso dei crawler di IA: decidi quali bot di IA possono recuperare il sito prima di pubblicare un indice
- Accesso dei crawler di IA: il controllo di Silktide sui blocchi in robots.txt
- Contenuti leggibili senza JavaScript: rendi le pagine collegate recuperabili come testo
- Markup dei dati strutturati: fatti leggibili dalle macchine direttamente nelle pagine
- Struttura della pagina con la risposta prima: cosa dovrebbero comunicare quelle pagine quando arriva un agente
- Il file /llms.txt (llmstxt.org)
- Google: ottimizzazione per le funzionalità di IA generativa: nota ufficiale sul fatto che la Ricerca Google ignora llms.txt