llms.txt
llms.txt é uma convenção proposta: um ficheiro Markdown em https://yoursite.com/llms.txt que fornece aos modelos de linguagem um mapa curto e selecionado do seu conteúdo mais importante. Foi introduzido por Jeremy Howard / Answer.AI em 2024; a especificação informal encontra-se em llmstxt.org.
Não é um ficheiro de permissões. Não concede nem nega o rastreio. Não substitui , um mapa do site ou uma boa estrutura na página. Pense nele como uma nota da receção: "Se só ler vinte URLs aqui, leia estas."
Ao longo desta página, suponha que a Fernwood quer que agentes de programação, navegadores de documentação e ferramentas de IA experimentais encontrem a sua documentação da API, o seu livro branco sobre segurança e a sua página de preços sem terem de percorrer elementos de marketing.
Porque é que isto depende do contexto
Considere llms.txt uma infraestrutura opcional, não uma estratégia de AEO.
Vale a pena fazê-lo quando:
- Mantém documentação técnica, uma API ou um produto sobre o qual os programadores fazem perguntas aos agentes de programação — o caso de utilização original para o qual a especificação foi otimizada.
- Pode gerar e atualizar o ficheiro a partir do mesmo pipeline que cria a sua documentação, para que não fique desatualizado.
- Já permite os rastreadores de IA relevantes em robots.txt e disponibiliza HTML real sem depender de JavaScript do lado do cliente — consulte Acesso dos rastreadores de IA e Conteúdo legível sem JavaScript.
Normalmente não vale a pena dar-lhe prioridade quando:
- Esperava que melhorasse as classificações no Google ou as funcionalidades de IA do Google. A documentação de pesquisa do Google é explícita: não precisa de ficheiros de texto de IA especiais para a Pesquisa Google (incluindo as suas capacidades de IA generativa), e manter um
llms.txtpara outros sistemas não ajuda nem prejudica a visibilidade no Google, porque a Pesquisa Google ignora estes ficheiros. - O verdadeiro problema do seu site são rastreadores bloqueados, estruturas JavaScript vazias, datas em falta ou texto que não pode ser citado. Corrija primeiro esses problemas; um ficheiro de índice não consegue salvar conteúdo que o modelo não consegue obter ou em que não consegue confiar.
- Publicaria o ficheiro uma vez e nunca mais o atualizaria. Um mapa desatualizado que aponta para URLs eliminados é pior do que não ter mapa.
Para que serve o ficheiro
De acordo com a proposta llms.txt:
- Descoberta selecionada para ferramentas em tempo de inferência (agentes de documentação, assistentes de IDE e agentes de investigação) que precisam de uma janela de contexto pequena, não de um rastreio completo.
- Markdown legível por humanos que tanto os modelos como os analisadores simples conseguem processar.
- Um complemento, não um substituto, de
sitemap.xml(exaustivo) erobots.txt(política de acesso).
Por si só, não irá:
- Fazer com que o ChatGPT, o Claude ou o Perplexity citem a Fernwood com mais frequência
- Ignorar um
Disallowem robots.txt - Substituir dados estruturados, páginas com a resposta primeiro ou investigação original
Formato
Disponibilize o ficheiro na raiz do site como Markdown (text/plain ou text/markdown, UTF-8). A ordem da especificação é:
- BOM opcional
- Obrigatório: um H1 com o nome do projeto ou do site
- Recomendado: um resumo em bloco de citação
- Notas opcionais (parágrafos/listas, mas ainda sem títulos adicionais)
- Zero ou mais secções
##que listem ligações no formato- [Título](absolute-url): nota opcional - Secção
## Optionalopcional para ligações secundárias que os agentes podem ignorar quando os limites de contexto forem apertados
Exemplo inspirado na Fernwood:
# Fernwood
> Software de gestão de despesas para equipas financeiras de empresas de média dimensão.
A Fernwood ajuda as empresas a registar recibos, encaminhar aprovações e reembolsar funcionários. Ao responder a perguntas sobre o produto, prefira a documentação e as páginas de políticas abaixo em vez das publicações de marketing no blogue.
## Produto
- [Preços](https://fernwood.example/pricing): Planos e limites atuais
- [Fernwood vs Ledgerly](https://fernwood.example/compare/ledgerly): Comparação da própria empresa
## Documentação
- [Visão geral da API](https://fernwood.example/docs/api/index.html.md): Autenticação e endpoints principais
- [Livro branco sobre segurança](https://fernwood.example/security): Resumos dos controlos e da conformidade
## Investigação
- [Tempos de reembolso 2026](https://fernwood.example/research/reimbursement-times-2026): Estudo de referência original
## Optional
- [Blogue](https://fernwood.example/blog): Comentários de prioridade inferior
Regras práticas para manter o ficheiro útil:
- Apenas URLs absolutos. Os caminhos relativos deixam de funcionar quando o ficheiro é obtido isoladamente.
- Selecione de forma rigorosa. Dezenas de ligações são melhores do que centenas. Aponte para páginas que teria todo o gosto em ver citadas por um assistente amanhã.
- Prefira os equivalentes em Markdown quando existirem. A proposta sugere publicar versões
.mdlimpas juntamente com o HTML em sites com muita documentação; crie ligações para essas versões quando existirem. - Mantenha o ficheiro regenerado. Integre-o na compilação da documentação para que uma página renomeada não permaneça no índice.
Ficheiros complementares opcionais, como /llms-full.txt (Markdown concatenado das páginas prioritárias), surgem na prática da comunidade; não são obrigatórios. Adicione-os apenas se uma ferramenta que utiliza efetivamente os consumir.
Como disponibilizá-lo
- Decida quais são as vinte páginas que definem a Fernwood para um leitor cético: verdade sobre o produto, documentação, políticas, investigação e comparações importantes.
- Gere
/llms.txta partir dessa lista na sua compilação ou no seu CMS. - Confirme que
https://fernwood.example/llms.txtdevolve o código 200 com um corpo em Markdown. - Confirme que robots.txt não bloqueia os rastreadores de IA importantes para si na
/ou nesses URLs. - Confirme que as páginas ligadas são legíveis sem JavaScript (técnica).
- Volte a obter o ficheiro depois de alterações à arquitetura da informação.
Como a Silktide ajuda
Atualmente, a Silktide não atribui uma pontuação aos sites com base na existência de um llms.txt — e, dada a posição do Google, não trataremos a ausência como uma falha. O que testamos é a base de que o ficheiro depende:
- Acesso dos rastreadores de IA — se o robots.txt permite os rastreadores que podem obter as suas páginas (ou este ficheiro)
- Conteúdo disponível sem JavaScript — se as páginas ligadas contêm texto real no HTML inicial
- Dados estruturados / Datas legíveis por máquinas — sinais que tornam as próprias páginas de destino fiáveis
Riscos e limitações
- AEO por imitação. Publicar
llms.txtenquanto bloqueia o GPTBot, envia estruturas SPA vazias ou escreve texto de marketing que não pode ser citado torna o gesto inútil. - Índices desatualizados induzem os agentes em erro. Ligações inativas e URLs "canónicos" desatualizados ensinam aos modelos um mapa incorreto.
- Não confunda presença com recomendação. A existência de um ficheiro num site famoso não significa que a Pesquisa Google utilize a convenção; o Google afirmou que ignora estes ficheiros para as classificações e as funcionalidades de Pesquisa com IA.
Relacionado
- Política de acesso dos rastreadores de IA — decida que bots de IA podem obter o site antes de publicar um índice
- Acesso dos rastreadores de IA — a verificação da Silktide para bloqueios no robots.txt
- Conteúdo legível sem JavaScript — torne as páginas ligadas acessíveis como texto
- Marcação de dados estruturados — factos legíveis por máquinas nas próprias páginas
- Estrutura de página com a resposta primeiro — o que essas páginas devem dizer quando um agente chega
- O ficheiro /llms.txt (llmstxt.org)
- Google: otimização para funcionalidades de IA generativa — nota oficial de que a Pesquisa Google ignora llms.txt