5 min de leitura
llms.txt: o que é e se o site do seu consultório precisa de um


Gabriel BusquetDesign e desenvolvimento
O llms.txt é um arquivo de texto em Markdown, publicado dentro do site, que apresenta um resumo do conteúdo e uma lista de links para as páginas mais importantes, pensado para ser lido por modelos de linguagem e agentes de IA. É uma proposta feita por Jeremy Howard em setembro de 2024, descrita em llmstxt.org. Não é um padrão oficial, as documentações de robôs de IA que consultamos não dizem que eles leem o arquivo, e o site de um consultório funciona bem sem ele.
O que a proposta diz
O argumento é simples. Páginas da web são feitas para pessoas, e o HTML embrulha a informação em menus, scripts e elementos visuais. Um agente de IA que precisa de um dado tem de separar o conteúdo desse entorno. O llms.txt ofereceria um atalho: um índice curto, escrito em texto limpo, apontando para o que interessa.
A página da proposta foi atualizada em agosto de 2026 para uma segunda versão, que o autor diz refletir dois anos de adoção. Ela continua se apresentando como proposta, aberta a contribuições da comunidade. Segundo o texto, o arquivo pode ficar na raiz do site, no endereço /llms.txt, ou em qualquer caminho dentro dele.
Formato do arquivo
A estrutura segue uma ordem fixa, e só o primeiro item é obrigatório.
- Um título de primeiro nível com o nome do site ou do projeto.
- Um parágrafo de resumo, em formato de citação.
- Parágrafos opcionais com detalhes, sem subtítulos.
- Seções de segundo nível com listas de links, cada link com uma nota curta opcional.
- Uma seção chamada Optional, com links secundários que o agente pode pular.
A proposta traz ainda uma segunda recomendação: oferecer uma versão em Markdown de cada página, no mesmo endereço com .md no final.
Diferença para robots.txt e sitemap
| Arquivo | Função | Situação |
|---|---|---|
| robots.txt | Diz a cada robô o que ele pode acessar | Convenção antiga, respeitada pelos buscadores e documentada pelas empresas de IA |
| sitemap.xml | Lista as páginas indexáveis do site para os buscadores | Usado e documentado pelos buscadores |
| llms.txt | Resume o site e aponta as páginas principais para agentes de IA | Proposta, de uso voluntário, sem leitura documentada pelos robôs das ferramentas de IA consultadas |
O llms.txt não controla acesso. Quem libera ou bloqueia um robô é o robots.txt. A própria proposta diz que os dois arquivos têm finalidades diferentes e que o llms.txt pode complementar o robots.txt dando contexto sobre o conteúdo liberado. Ela também afirma que o arquivo não substitui o sitemap.
Quem usa hoje
A adoção está concentrada em documentação técnica. OpenAI, Anthropic e Google publicam arquivos llms.txt para a documentação de seus produtos para desenvolvedores, o que faz sentido: programadores usam assistentes de código que precisam consultar manuais de API o tempo todo. A página da proposta lista ainda plataformas de documentação e plugins de WordPress que geram o arquivo automaticamente, e cita que o Lighthouse, ferramenta de auditoria do Chrome, verifica a presença dele.
Publicar o próprio llms.txt é diferente de ler o dos outros. As páginas em que a OpenAI, a Anthropic e a Perplexity documentam seus robôs explicam como cada um se identifica e como responde ao robots.txt. Na leitura que fizemos para esta matéria, nenhuma delas afirma que o robô procura ou usa o llms.txt dos sites que visita.
O Google é mais direto. Na documentação sobre AI Overviews e Modo IA, afirma que não é preciso criar novos arquivos legíveis por máquina nem arquivos de texto para IA para aparecer nesses recursos.
Hoje, o que se pode afirmar é que o llms.txt existe, é barato de fazer e não tem efeito comprovado sobre aparecer em resposta de IA.
O que ainda não se sabe
Falta saber com que frequência os agentes de IA de uso geral consultam o arquivo quando ele existe. A proposta fala em expectativa: espera-se que os agentes vejam ou pesquisem o llms.txt quando precisarem de informação. Expectativa do autor e comportamento documentado dos produtos são coisas distintas, e só o segundo permitiria planejar em cima.
Também não há evidência pública de que o arquivo influencie a escolha das fontes numa resposta. Pode ser que a convenção se firme e passe a ser lida de forma ampla, como aconteceu com o robots.txt. Pode ser que fique restrita à documentação de software. Qualquer afirmação mais forte do que essa, no momento, é palpite.
O caso de um consultório
Um site de consultório tem poucas páginas: início, sobre o médico, especialidades ou procedimentos, convênios, contato, talvez um blog. Um agente de IA que chega a esse site lê tudo sem dificuldade se o HTML for limpo. O problema que o llms.txt resolve, o de achar a página certa num site com milhares delas, quase não existe aqui.
Antes de pensar no arquivo, confira se o básico está feito, porque é o básico que tem respaldo na documentação das empresas:
- O texto das páginas aparece no código-fonte, sem depender de JavaScript.
- Especialidade, CRM, RQE, endereço, horários e convênios estão escritos em texto, e não só em imagem.
- O robots.txt não bloqueia os robôs de busca das ferramentas de IA.
- Os dados estruturados conferem com o que está visível na página.
- Telefone e endereço são os mesmos no site, no perfil do Google e nos diretórios.
Com isso em ordem, criar o llms.txt custa pouco e não faz mal.
Cuidados ao publicar
Se o seu plugin de SEO ou a sua plataforma já gera o arquivo, abra o endereço do site seguido de /llms.txt e leia o que está lá. Arquivos gerados automaticamente às vezes listam páginas de teste, rascunhos publicados por engano ou descrições genéricas que não dizem o que você faz.
- 1Escreva o resumo como você se apresentaria a um paciente: nome, especialidade, cidade e bairro, tipo de atendimento.
- 2Liste só as páginas que você quer que sejam lidas, com uma frase sobre o conteúdo de cada uma.
- 3Use exatamente os mesmos dados do site. Um horário no arquivo e outro na página de contato cria a contradição que você quer evitar.
- 4Anote na agenda uma revisão sempre que mudar endereço, equipe ou convênios.
Um llms.txt desatualizado é pior do que nenhum, porque oferece a uma máquina, em formato fácil de copiar, uma informação errada sobre o consultório.
Fontes
- llmstxt.org: The /llms.txt file
- Google Search Central: AI Features and Your Website
- OpenAI: Overview of OpenAI Crawlers
- Anthropic: Does Anthropic crawl data from the web, and how can site owners block the crawler?
- Perplexity: Perplexity Crawlers
- OpenAI Developers: arquivo llms.txt da documentação
- Anthropic: arquivo llms.txt da documentação para desenvolvedores
- Google: arquivo llms.txt da documentação da Gemini API
- Google Search Central: Robots.txt Introduction and Guide







