Page for Doctor
Todas as matérias
IA e buscas

5 min de leitura

llms.txt: o que é e se o site do seu consultório precisa de um

Gabriel BusquetDesign e desenvolvimento

O llms.txt é um arquivo de texto em Markdown, publicado dentro do site, que apresenta um resumo do conteúdo e uma lista de links para as páginas mais importantes, pensado para ser lido por modelos de linguagem e agentes de IA. É uma proposta feita por Jeremy Howard em setembro de 2024, descrita em llmstxt.org. Não é um padrão oficial, as documentações de robôs de IA que consultamos não dizem que eles leem o arquivo, e o site de um consultório funciona bem sem ele.

O que a proposta diz

O argumento é simples. Páginas da web são feitas para pessoas, e o HTML embrulha a informação em menus, scripts e elementos visuais. Um agente de IA que precisa de um dado tem de separar o conteúdo desse entorno. O llms.txt ofereceria um atalho: um índice curto, escrito em texto limpo, apontando para o que interessa.

A página da proposta foi atualizada em agosto de 2026 para uma segunda versão, que o autor diz refletir dois anos de adoção. Ela continua se apresentando como proposta, aberta a contribuições da comunidade. Segundo o texto, o arquivo pode ficar na raiz do site, no endereço /llms.txt, ou em qualquer caminho dentro dele.

Formato do arquivo

A estrutura segue uma ordem fixa, e só o primeiro item é obrigatório.

  • Um título de primeiro nível com o nome do site ou do projeto.
  • Um parágrafo de resumo, em formato de citação.
  • Parágrafos opcionais com detalhes, sem subtítulos.
  • Seções de segundo nível com listas de links, cada link com uma nota curta opcional.
  • Uma seção chamada Optional, com links secundários que o agente pode pular.

A proposta traz ainda uma segunda recomendação: oferecer uma versão em Markdown de cada página, no mesmo endereço com .md no final.

Diferença para robots.txt e sitemap

ArquivoFunçãoSituação
robots.txtDiz a cada robô o que ele pode acessarConvenção antiga, respeitada pelos buscadores e documentada pelas empresas de IA
sitemap.xmlLista as páginas indexáveis do site para os buscadoresUsado e documentado pelos buscadores
llms.txtResume o site e aponta as páginas principais para agentes de IAProposta, de uso voluntário, sem leitura documentada pelos robôs das ferramentas de IA consultadas

O llms.txt não controla acesso. Quem libera ou bloqueia um robô é o robots.txt. A própria proposta diz que os dois arquivos têm finalidades diferentes e que o llms.txt pode complementar o robots.txt dando contexto sobre o conteúdo liberado. Ela também afirma que o arquivo não substitui o sitemap.

Quem usa hoje

A adoção está concentrada em documentação técnica. OpenAI, Anthropic e Google publicam arquivos llms.txt para a documentação de seus produtos para desenvolvedores, o que faz sentido: programadores usam assistentes de código que precisam consultar manuais de API o tempo todo. A página da proposta lista ainda plataformas de documentação e plugins de WordPress que geram o arquivo automaticamente, e cita que o Lighthouse, ferramenta de auditoria do Chrome, verifica a presença dele.

Publicar o próprio llms.txt é diferente de ler o dos outros. As páginas em que a OpenAI, a Anthropic e a Perplexity documentam seus robôs explicam como cada um se identifica e como responde ao robots.txt. Na leitura que fizemos para esta matéria, nenhuma delas afirma que o robô procura ou usa o llms.txt dos sites que visita.

O Google é mais direto. Na documentação sobre AI Overviews e Modo IA, afirma que não é preciso criar novos arquivos legíveis por máquina nem arquivos de texto para IA para aparecer nesses recursos.

Hoje, o que se pode afirmar é que o llms.txt existe, é barato de fazer e não tem efeito comprovado sobre aparecer em resposta de IA.

O que ainda não se sabe

Falta saber com que frequência os agentes de IA de uso geral consultam o arquivo quando ele existe. A proposta fala em expectativa: espera-se que os agentes vejam ou pesquisem o llms.txt quando precisarem de informação. Expectativa do autor e comportamento documentado dos produtos são coisas distintas, e só o segundo permitiria planejar em cima.

Também não há evidência pública de que o arquivo influencie a escolha das fontes numa resposta. Pode ser que a convenção se firme e passe a ser lida de forma ampla, como aconteceu com o robots.txt. Pode ser que fique restrita à documentação de software. Qualquer afirmação mais forte do que essa, no momento, é palpite.

O caso de um consultório

Um site de consultório tem poucas páginas: início, sobre o médico, especialidades ou procedimentos, convênios, contato, talvez um blog. Um agente de IA que chega a esse site lê tudo sem dificuldade se o HTML for limpo. O problema que o llms.txt resolve, o de achar a página certa num site com milhares delas, quase não existe aqui.

Antes de pensar no arquivo, confira se o básico está feito, porque é o básico que tem respaldo na documentação das empresas:

  • O texto das páginas aparece no código-fonte, sem depender de JavaScript.
  • Especialidade, CRM, RQE, endereço, horários e convênios estão escritos em texto, e não só em imagem.
  • O robots.txt não bloqueia os robôs de busca das ferramentas de IA.
  • Os dados estruturados conferem com o que está visível na página.
  • Telefone e endereço são os mesmos no site, no perfil do Google e nos diretórios.

Com isso em ordem, criar o llms.txt custa pouco e não faz mal.

Cuidados ao publicar

Se o seu plugin de SEO ou a sua plataforma já gera o arquivo, abra o endereço do site seguido de /llms.txt e leia o que está lá. Arquivos gerados automaticamente às vezes listam páginas de teste, rascunhos publicados por engano ou descrições genéricas que não dizem o que você faz.

  1. 1Escreva o resumo como você se apresentaria a um paciente: nome, especialidade, cidade e bairro, tipo de atendimento.
  2. 2Liste só as páginas que você quer que sejam lidas, com uma frase sobre o conteúdo de cada uma.
  3. 3Use exatamente os mesmos dados do site. Um horário no arquivo e outro na página de contato cria a contradição que você quer evitar.
  4. 4Anote na agenda uma revisão sempre que mudar endereço, equipe ou convênios.

Um llms.txt desatualizado é pior do que nenhum, porque oferece a uma máquina, em formato fácil de copiar, uma informação errada sobre o consultório.

Fontes

Leia a seguir