---
title: "O que é o llms.txt e há alguma IA que o leia mesmo?"
description: "O llms.txt é um índice markdown proposto para modelos de IA. A Google diz que não o vai usar e a Ahrefs verificou que 97 % dos ficheiros não recebem pedidos."
lang: pt
canonical: https://upgradepro.eu/pt/blog/llms-txt-guide
published: 2026-07-16
tags: ["GEO", "técnico"]
---

# O que é o llms.txt e há alguma IA que o leia mesmo?

> O llms.txt é um índice markdown proposto para modelos de IA. A Google diz que não o vai usar e a Ahrefs verificou que 97 % dos ficheiros não recebem pedidos.

O llms.txt é um ficheiro markdown proposto, servido na raiz de um site, que dá aos grandes modelos de linguagem um índice com curadoria dos conteúdos essenciais desse site. Jeremy Howard, da Answer.AI, publicou a especificação a 3 de setembro de 2024. Em 2026, nenhum grande motor de IA declara suporte: a Google rejeitou-o explicitamente, a documentação do crawler da OpenAI nunca o menciona e a Ahrefs verificou que 97 % dos ficheiros publicados não recebem qualquer pedido. Eis o formato, a evidência e quando ainda faz sentido tê-lo.

## O que é o llms.txt e de onde vem?

O llms.txt é uma proposta de Jeremy Howard, cofundador da Answer.AI e da fast.ai, publicada a 3 de setembro de 2024 em [llmstxt.org](https://llmstxt.org/). Não é uma norma web ratificada; nenhum fornecedor de IA está obrigado a lê-lo e a adoção é inteiramente voluntária.

O problema que ataca é uma limitação real. Os modelos de linguagem funcionam dentro dos limites de uma janela de contexto, e a especificação parte daí. A resposta de Howard é um ficheiro markdown compacto em `/llms.txt`, escrito para ajudar os LLM a usar um site no momento da inferência: um resumo curto mais ligações para as páginas que interessam, num formato dimensionado para esses limites.

A especificação vai além do ficheiro único. Propõe também publicar uma versão limpa em markdown de cada página no mesmo URL com `.md` acrescentado (e `index.html.md` para URL sem nome de ficheiro). O caso de uso que a especificação destaca são os ambientes de desenvolvimento, onde os LLM precisam de acesso rápido a documentação de programação e de API.

O llms.txt é uma entrada recorrente nas [checklists de generative engine optimization](/pt/blog/what-is-geo). Se merece esse lugar é precisamente o que este guia examina.

## Como é um ficheiro llms.txt correto?

O formato é mínimo, segundo a [especificação oficial](https://llmstxt.org/) (setembro de 2024). Um H1 com o nome do site é a única secção obrigatória. Depois, por esta ordem:

1. Um blockquote com um resumo breve do site.
2. Zero ou mais secções markdown com contexto que valha a pena conhecer.
3. Zero ou mais listas de ficheiros, cada uma delimitada por um H2, com ligações no formato `[nome](url)` seguidas opcionalmente de `: nota`.
4. Uma secção especial chamada "Optional" para material secundário que pode ser descartado quando é preciso um contexto mais curto.

Um esqueleto com marcadores de posição tem este aspeto:

```markdown
# Empresa Exemplo

> Resumo numa frase do que a empresa faz e para quem.

Parágrafo curto de contexto que um modelo de linguagem deve conhecer.

## Documentação

- [Guia rápido](https://example.com/docs/quickstart.md): instalação e primeiros passos
- [Referência da API](https://example.com/docs/api.md): endpoints e autenticação

## Optional

- [História da empresa](https://example.com/about.md)
```

## Em que difere o llms.txt do robots.txt e do sitemap.xml?

Fazem trabalhos diferentes: o robots.txt controla o acesso dos crawlers, o sitemap.xml lista URL para indexação e o llms.txt é um guia de conteúdos com curadoria, sem qualquer poder de imposição. Não bloqueia nada e não permite nada.

| Ficheiro | O que faz | Suporte oficial hoje |
|---|---|---|
| robots.txt | Permite ou bloqueia o acesso dos crawlers | O único mecanismo de controlo documentado pela OpenAI (developers.openai.com/api/docs/bots) |
| sitemap.xml | Lista URL para descoberta e indexação | Norma consolidada dos motores de busca |
| llms.txt | Índice markdown com curadoria para LLM | Nenhum grande motor de IA declara que lê o ficheiro (2026) |
| llms-full.txt | Toda a documentação num único ficheiro markdown | Gerado automaticamente por plataformas como o Mintlify |

A [documentação oficial dos crawlers da OpenAI](https://developers.openai.com/api/docs/bots) (consultada em julho de 2026) cobre o GPTBot, o OAI-SearchBot, o OAI-AdsBot e o ChatGPT-User, nomeia o robots.txt como único mecanismo de controlo e nunca menciona o llms.txt. Se o seu objetivo real é gerir o acesso dos bots de IA, isso é trabalho do robots.txt — o nosso [guia dos crawlers de IA](/pt/blog/ai-crawlers-guide) trata do tema.

O llms-full.txt é o irmão maximalista: em vez de um índice, despeja toda a documentação num único ficheiro markdown. O seu limite prático é o tamanho — em sites grandes pode exceder a janela de contexto de muitos modelos, pelo que serve mais para ingestão deliberada do que para descoberta.

## Quem publica de facto um llms.txt?

Sobretudo plataformas que o geram pelos seus utilizadores, não sites que o escolheram: 78,1 % dos sites Shopify publicam um por implementação automática, contra 5,61 % de adoção no top 10.000 em geral, segundo a [análise de HTTP Archive de Casey Burridge](https://caseyrb.com/blog/state-of-llms-txt-adoption/) (junho de 2026). O caso de uso com sinal real nos logs de servidor é mais estreito — documentação técnica — e mesmo aí o ficheiro chega muitas vezes pelo alojamento da documentação e não pelo dono do site.

- **A Anthropic** publica um a sério: docs.anthropic.com/llms.txt redireciona (301) para [platform.claude.com/docs/llms.txt](https://platform.claude.com/docs/llms.txt), um índice markdown encabeçado por "Anthropic Developer Documentation" com secções de ligações por linguagem e por categoria (verificado a 16 de julho de 2026).
- **A Perplexity** serve [docs.perplexity.ai/llms.txt](https://docs.perplexity.ai/llms.txt), com um H1 e um blockquote a descrever as suas API.
- **O Mintlify** ativou a geração automática de `/llms.txt` e `/llms-full.txt` para todos os sites de documentação que aloja a [20 de novembro de 2024](https://www.mintlify.com/blog/simplifying-docs-with-llms-txt), citando a Anthropic, o Windsurf e o Bolt.new. Milhares de sites de documentação ficaram com o ficheiro de um dia para o outro.

Repare na assimetria: os laboratórios de IA usam o llms.txt na sua própria documentação, mas nenhum declarou que os seus motores consomem o ficheiro em sites de terceiros. Segundo a [análise de HTTP Archive de Casey Burridge](https://caseyrb.com/blog/state-of-llms-txt-adoption/) (junho de 2026), o ChatGPT, o Claude e o Gemini não têm llms.txt nos seus domínios principais — apenas na documentação para programadores.

## Quantos sites já adotaram o llms.txt?

Entre cerca de 5 % e 28 %, dependendo inteiramente da amostra que se mede. Os números de destaque divergem porque as metodologias divergem.

Segundo o [conjunto de dados de HTTP Archive de Burridge](https://caseyrb.com/blog/state-of-llms-txt-adoption/) (julho de 2025 a junho de 2026), a adoção nos 10.000 sites de topo cresceu de 1,04 % para 5,61 % em doze meses — cerca de 5,4×. Por plataforma, o Shopify lidera: 78,1 % dos sites Shopify publicam um, impulsionados pela implementação automática da plataforma e não por adoção orgânica, enquanto o WordPress fica perto dos 8,7 %. Segundo a [Ahrefs](https://ahrefs.com/blog/llmstxt-study/) (logs de maio de 2026), 28 % dos 137.210 domínios com tráfego publicam um llms.txt válido — cerca de 38.000 sites.

Os agregadores reportam ainda outros valores: a Rankability aponta uma adoção de [8,7 % no top 1.000 global](https://www.rankability.com/data/llms-txt-adoption/) (junho de 2026), outra análise de ~300.000 domínios encontrou ~10,13 % e a ppc.land refere um crescimento de 8,8× em doze meses, de 4.088 para 36.120 ficheiros.

A dispersão é método, não contradição: amostras de domínios, critérios de validade e fontes de dados diferentes. Dois sinais mantêm-se em todos os estudos. A adoção cresce depressa e boa parte dela vem de plataformas — Shopify, Mintlify e [Yoast SEO](https://yoast.com/features/llms-txt/), que gera o llms.txt automaticamente como funcionalidade gratuita do WordPress, ao mesmo tempo que a sua própria página de produto evita garantir que as plataformas de IA o utilizam.

## A Google usa o llms.txt?

Não — e a Google já o disse pelo menos três vezes, em graus crescentes de formalidade.

Em abril de 2025, John Mueller escreveu no Reddit (r/TechSEO), como noticiou o [Search Engine Journal](https://www.searchenginejournal.com/google-says-llms-txt-comparable-to-keywords-meta-tag/544804/), que nenhum serviço de IA disse usar o llms.txt, que os logs de servidor mostram que nem sequer o procuram, e que o ficheiro lhe fazia lembrar a meta tag keywords — o exemplo clássico de metadados que os motores de busca aprenderam a ignorar.

Em julho de 2025, Gary Illyes foi mais direto no evento Search Central Deep Dive APAC:

> "Google doesn't support LLMs.txt and isn't planning to"
> — Gary Illyes (Google), citado pelo [Search Engine Land](https://searchengineland.com/google-says-normal-seo-works-for-ranking-in-ai-overviews-and-llms-txt-wont-be-used-459422), 24 de julho de 2025

Segundo a mesma notícia, Illyes acrescentou que o SEO normal basta para aparecer nas AI Overviews. E a [documentação oficial da Google Search Central](https://developers.google.com/search/docs/appearance/ai-features) sobre funcionalidades de IA (atualizada a 10 de dezembro de 2025) diz claramente que não é preciso criar novos ficheiros legíveis por máquina, ficheiros de texto para IA ou marcação para aparecer nessas funcionalidades.

Mueller apontou ainda uma falha estrutural, segundo a cobertura do Search Engine Journal: um site poderia mostrar uma coisa no llms.txt e outra aos utilizadores e aos motores de busca. Esse risco de cloaking obriga qualquer bot sério a verificar na mesma a página real — o que torna o ficheiro redundante.

## O ChatGPT ou o Claude leem o llms.txt?

Nenhuma das empresas o afirma. A documentação dos crawlers da OpenAI nomeia o robots.txt como único mecanismo e não contém qualquer declaração de que o GPTBot ou o ChatGPT leiam o llms.txt. A Anthropic publica o ficheiro para a sua própria documentação para programadores, mas não declarou que o Claude consome ficheiros llms.txt de terceiros — é a ausência de uma afirmação, não um desmentido.

O único sinal positivo vive nos logs de servidor. Dentro da minoria de acessos a llms.txt que a [Ahrefs](https://ahrefs.com/blog/llmstxt-study/) (maio de 2026) atribuiu a ferramentas de IA, destacaram-se o GPTBot e o Claude-Code. Isso aponta para assistentes de programação a puxar documentação técnica — não para motores de busca de IA a descobrir sites comuns.

## O que revelam os logs de servidor sobre o llms.txt?

Um silêncio quase total. No [estudo da Ahrefs](https://ahrefs.com/blog/llmstxt-study/) sobre 137.210 domínios (logs de maio de 2026), 97 % dos ficheiros llms.txt publicados não receberam um único pedido. A conclusão da própria Ahrefs: "AI search bots barely fetch these files, and no AI system goes looking for one."

O tráfego que chegou era sobretudo ruído. 96 % dos pedidos vieram de bots — ferramentas de auditoria SEO (21,7 %), bots não identificados (14,9 %), crawlers generalistas (13,1 %) e perfiladores de tecnologia como o BuiltWith (11,6 %). As ferramentas de IA representaram 19,5 % desses acessos, lideradas pelo GPTBot e pelo Claude-Code, mas apenas cerca de 1,1 % dos pedidos vieram de bots de recuperação de IA — o público teórico do ficheiro.

Na etiquetagem da UpgradePro, isso faz de qualquer benefício de tráfego do llms.txt um SUPOSTO, não um resultado MEDIDO. Ninguém publicou logs que mostrem o contrário.

## Deve criar um ficheiro llms.txt?

Crie-o se não lhe custar nada; ignore-o se roubar trabalho real a coisas que são efetivamente lidas. A evidência sustenta uma decisão baseada no custo, não no entusiasmo.

| Situação | Veredito |
|---|---|
| Documentação para programadores, API ou produto SaaS | Melhor caso: os assistentes de programação (GPTBot, Claude-Code) mostram acessos reais nos logs |
| Documentação alojada no Mintlify | Já está feito automaticamente desde novembro de 2024 |
| Site WordPress com Yoast SEO | Ative a funcionalidade gratuita; custo quase nulo, sem tráfego esperado |
| Site montra de PME ou de serviço local | Baixa prioridade: nenhum motor o lê e não há documentação para indexar |

Decida o que decidir, não financie isto à custa de trabalho com evidência real por trás. HTML limpo e rastreável, conteúdos que respondem primeiro e [dados estruturados que os sistemas de IA analisam](/pt/blog/structured-data-ai) têm mais direito às suas horas do que um ficheiro que em 97 % dos casos ninguém pede.

## O que fazer esta semana?

Uma rotina de 30 minutos, orientada pela evidência, para uma equipa pequena:

1. **Verifique os logs do seu servidor** à procura de pedidos a `/llms.txt` nos últimos 90 dias. Meça a procura antes de investir — é essa a diferença entre MEDIDO e SUPOSTO.
2. **No WordPress:** ative a geração gratuita de llms.txt do Yoast. O custo é quase nulo, por isso a evidência negativa não pesa.
3. **Em documentação no Mintlify:** já serve `/llms.txt` e `/llms-full.txt`; confirme que apresentam o conteúdo corretamente.
4. **Se o escrever à mão:** siga a especificação à risca — H1, blockquote, listas de ligações em H2 e uma secção "Optional". Vinte minutos, uma só vez.
5. **Não realoque orçamento** de rastreabilidade, estrutura de conteúdos ou dados estruturados para a manutenção do llms.txt.
6. **Reveja trimestralmente.** A adoção cresceu ~5,4× num ano; se algum motor anunciar suporte, as contas mudam — e os seus logs serão os primeiros a mostrá-lo.

E se quiser saber onde está hoje o seu site nas respostas de IA — medido antes e depois, não suposto — essa linha de base é exatamente o que entrega a nossa [auditoria de visibilidade em IA](/pt/services/ai-visibility).

## Perguntas frequentes

### O que é exatamente o llms.txt?

O llms.txt é uma proposta, não uma norma oficial, publicada por Jeremy Howard, cofundador da Answer.AI, a 3 de setembro de 2024 em llmstxt.org. É um ficheiro markdown colocado na raiz de um site (/llms.txt) que resume o que o site é e liga às suas páginas principais, num formato pensado para modelos de linguagem e para os limites da sua janela de contexto.

### A Google, o ChatGPT ou o Claude leem o llms.txt?

Não há qualquer evidência de suporte oficial. A Google negou-o repetidamente: John Mueller comparou o ficheiro à meta tag keywords em abril de 2025, Gary Illyes afirmou em julho de 2025 que a Google não o suporta nem tenciona suportar, e a documentação da Google Search Central diz que não são necessários novos ficheiros de texto para IA para aparecer nas funcionalidades de IA. A documentação do crawler da OpenAI só menciona o robots.txt, e o estudo da Ahrefs sobre 137.210 domínios concluiu que 97 % dos ficheiros llms.txt publicados não receberam qualquer pedido.

### O llms.txt substitui o robots.txt ou o mapa do site?

Não. O robots.txt controla o acesso dos crawlers e é o único mecanismo de controlo nomeado na documentação oficial do crawler da OpenAI, enquanto o sitemap.xml lista URL para indexação. O llms.txt é outra coisa: um guia de conteúdos com curadoria destinado a modelos de linguagem. Não bloqueia nada, não permite nada e nenhum grande motor de IA declara atualmente que o utiliza.

### Vale a pena criar um ficheiro llms.txt?

Depende do custo e do tipo de site. A evidência diz que quase ninguém o lê, por isso não espere tráfego por o ter. Ainda assim, o custo é quase nulo: o Yoast SEO gera-o gratuitamente no WordPress e o Mintlify cria-o automaticamente para sites de documentação. O caso de uso mais real é a documentação técnica consumida por assistentes de programação: no estudo de logs de servidor da Ahrefs, os poucos acessos de IA que ocorreram vieram sobretudo do GPTBot e do Claude-Code. Para uma pequena empresa sem documentação técnica é opcional e de baixa prioridade.

### Como se escreve um llms.txt correto?

Siga a especificação: um H1 com o nome do site (a única secção obrigatória), um blockquote com um resumo de uma ou duas frases, secções H2 com listas de ligações em que cada ligação markdown pode levar uma nota curta, e uma secção final Optional para conteúdos dispensáveis. A especificação sugere ainda publicar versões limpas em markdown das páginas principais no mesmo URL com .md acrescentado. Há exemplos em produção na documentação para programadores da Anthropic e da Perplexity.

### O que é o llms-full.txt e em que difere?

O llms.txt é um índice de ligações com curadoria; o llms-full.txt despeja toda a documentação do site num único ficheiro markdown. O Mintlify implementou ambos automaticamente em todos os sites de documentação que aloja, em novembro de 2024. Em sites grandes, o llms-full.txt pode exceder a janela de contexto de muitos modelos, pelo que funciona melhor para ingestão deliberada numa ferramenta do que para descoberta.

## Fontes

Todas as afirmações deste artigo remetem para a fonte de onde provêm, com a respetiva data de publicação.

- [llmstxt.org — official llms.txt specification (Jeremy Howard)](https://llmstxt.org/) — 2024-09-03
- [Mintlify — Simplifying docs with llms.txt](https://www.mintlify.com/blog/simplifying-docs-with-llms-txt) — 2024-11-20
- [Anthropic Developer Documentation — live llms.txt](https://platform.claude.com/docs/llms.txt) — 2026-07-16 (accessed)
- [Perplexity Docs — live llms.txt](https://docs.perplexity.ai/llms.txt) — 2026-07-16 (accessed)
- [OpenAI — Overview of OpenAI Crawlers (official documentation)](https://developers.openai.com/api/docs/bots) — 2026-07-16 (accessed)
- [Search Engine Journal — Google says LLMs.txt comparable to keywords meta tag (John Mueller on Reddit)](https://www.searchenginejournal.com/google-says-llms-txt-comparable-to-keywords-meta-tag/544804/) — 2025-04-17
- [Search Engine Land — Google says normal SEO works for AI Overviews and llms.txt won't be used (Gary Illyes)](https://searchengineland.com/google-says-normal-seo-works-for-ranking-in-ai-overviews-and-llms-txt-wont-be-used-459422) — 2025-07-24
- [Google Search Central — AI features and your website (official documentation)](https://developers.google.com/search/docs/appearance/ai-features) — 2025-12-10
- [Ahrefs — llms.txt study across 137,210 domains](https://ahrefs.com/blog/llmstxt-study/) — 2026-06 (May 2026 log data)
- [Casey Burridge — State of llms.txt adoption (HTTP Archive/BigQuery)](https://caseyrb.com/blog/state-of-llms-txt-adoption/) — 2026-06
- [Yoast — llms.txt feature page](https://yoast.com/features/llms-txt/) — 2025 (product page, accessed 2026-07-16)
- [Rankability / ppc.land — llms.txt adoption data (aggregators)](https://www.rankability.com/data/llms-txt-adoption/) — 2026-06
