llms.txt para o comércio agêntico: o que é, se funciona e como publicar um

Publicado em . Cada afirmação remete a uma fonte primária.

Resposta curta: o llms.txt é um pequeno arquivo Markdown na raiz do seu site (/llms.txt) que entrega a um modelo de linguagem um mapa curado das páginas que mais vale a pena ler. Foi proposto por Jeremy Howard, da Answer.AI, em 3 de setembro de 2024 e vive em llmstxt.org. O status honesto em 2026: publicar um já é comum e barato, mas nenhum grande fornecedor de IA confirmou publicamente que lê o seu arquivo. Para um site de comércio agêntico, isso o torna um seguro compatível com o futuro — um contrato estável e legível por máquina que você controla — em vez de um canal de tráfego garantido. Veja a seguir o que é, quem o lê e como publicar um bom. Para a referência mais profunda, o llmtxt.info mantém um guia neutro e com fontes sobre o que é o llms.txt.

O que o llms.txt realmente é

O argumento de Howard era simples: um modelo de linguagem tem uma janela de contexto pequena em comparação com um site completo, então pedir que ele rastreie tudo para responder a uma pergunta é desperdício e perda de informação. Os sites já publicam robots.txt para rastreadores e sitemap.xml para motores de busca; o llms.txt propõe uma convenção paralela voltada especificamente aos LLMs. O formato é deliberadamente mínimo: um H1 com o nome do site, um resumo de uma linha em uma citação em bloco e, depois, seções Markdown de links curados com descrições curtas. Ele se destina à inferência — o momento em que um usuário pergunta a um assistente sobre você — e não ao treinamento, e é curado por sinal, não por cobertura (Answer.AI, llmstxt.org).

Eis um exemplo real — o arquivo que este próprio site publica em /llms.txt, encurtado por questão de espaço:

# Agentic Commerce Protocol Info

> Neutral, up-to-date reference comparing the open standards
> behind agentic commerce: ACP, UCP, AP2, MCP and x402.

## Standards
- [Agentic Commerce Protocol (ACP)](/standards/acp): OpenAI + Stripe checkout.
- [Universal Commerce Protocol (UCP)](/standards/ucp): Google + Shopify.
- [x402](/standards/x402): Coinbase HTTP-native stablecoin payments.

## Core pages
- [ACP vs UCP vs AP2 vs MCP vs x402](/compare/acp-vs-ap2-vs-mcp): comparison table.
- [How AI agents pay](/how-ai-agents-pay): the agentic payments stack.
Figura 1 — Um llms.txt real: H1, um resumo em citação em bloco e, depois, seções curadas de links. Veja o arquivo completo em /llms.txt.

Como ele difere de robots.txt e sitemap.xml

Os três arquivos são complementares, não intercambiáveis. O enquadramento mais claro: o robots.txt diz o que um rastreador pode buscar, o sitemap.xml diz o que existe e o llms.txt diz o que vale a pena ler. Apenas os dois primeiros são padrões formais. O llmtxt.info mantém um detalhamento mais completo de llms.txt vs robots.txt vs sitemap.xml.

ArquivoPúblicoFinalidadeÉ um padrão?
robots.txtRastreadores webControle de acesso (permitir / bloquear)Sim — IETF RFC 9309
sitemap.xmlMotores de buscaDescoberta — listar todas as páginasSim — sitemaps.org
llms.txtAssistentes LLMCuradoria — o que ler primeiroNão — proposta da comunidade
llms-full.txtAssistentes LLMInlining — o conteúdo de fato em um único arquivoNão — proposta da comunidade

Fontes: IETF RFC 9309, llmstxt.org.

Será que funciona mesmo? A resposta honesta, com dois lados

É aqui que a maioria dos textos exagera. O lado da oferta e o lado da demanda estão se movendo em velocidades muito diferentes, e confundi-los é o erro mais comum de todos.

Lado da oferta — real e crescenteLado da demanda — não confirmadoSites publicando /llms.txtAnthropic · Cloudflare · StripeVercel · Mintlify · Perplexity≈10% de 300 mil domínios amostrados↑ adotandoFornecedores de IA lendo seu arquivoOpenAI / Anthropic / Google /docs dos rastreadores Perplexity: em silêncioNenhum compromisso público de consumir? não comprovado
Figura 2 — Publicar llms.txt é comum; fornecedores consumindo arquivos de terceiros não está documentado. O número de ~10% de adoção vem de uma análise de 300.000 domínios divulgada pelo Search Engine Journal (nov. 2025). O llmtxt.info mantém a resposta com fontes sobre se o Google e o ChatGPT o utilizam.

Então por que publicar um? Porque o custo é de minutos e o risco é zero. As plataformas de documentação já o geram automaticamente; os frameworks de agentes e os pipelines de RAG cada vez mais o procuram; e, quando o consumo de fato chegar, um arquivo curado e preciso é um contrato que você já controla. Para uma marca de comércio que também se importa em ser lida corretamente pelos agentes de compras — o tema do nosso artigo complementar sobre como os agentes de IA encontram e leem seus produtos — é um complemento de baixo esforço ao schema.org e a dados limpos renderizados no servidor.

Assista: llms.txt vs robots.txt vs sitemap.xml

O breve explicador da Webflow é um passo a passo claro do que é o arquivo, como ele difere dos dois arquivos com os quais costuma ser confundido e como publicar um.

Fonte: Webflow — “What Is an llms.txt file?” (canal oficial).

Como publicar um bom para um site de comércio

Todo o exercício é curadoria. Liste as 10–20 páginas de que um assistente precisaria para responder à pergunta real de um comprador, escreva uma linha limpa para cada uma e deixe todo o resto de fora.

  • Comece pela identidade — um H1 com sua marca e uma citação em bloco de uma frase sobre o que você vende e para quem.
  • Agrupe o essencial — coleções e produtos de destaque, envio & devoluções, guias de tamanho/especificações e páginas de políticas importantes, cada um como um link com uma nota curta.
  • Cure, não despeje — omita carrinho, checkout, login, busca e páginas rasas. Sinal vence cobertura.
  • Aponte para o HTML canônico (ou versões .md limpas), mantenha-o em UTF-8 e leve, e atualize-o quando conteúdos importantes mudarem.
  • Considere o llms-full.txt apenas se o texto do seu catálogo for pequeno o suficiente para ser embutido de forma útil.
  • Valide antes de publicar para que um parser o leia da forma que você pretende.

O llmtxt.info publica um guia passo a passo com modelos para copiar e colar, e você pode validar seu arquivo contra a especificação antes de implantá-lo.

Onde ele se encaixa na pilha do comércio agêntico

O llms.txt é a camada de legibilidade; os protocolos deste site são a camada de transação. Combine um arquivo limpo com o restante: leia como os agentes encontram e leem seus produtos, compare os padrões de pagamento e veja como aceitar pagamentos de agentes. A linha do tempo datada está no changelog.

Perguntas frequentes

O que é o llms.txt?
Um arquivo Markdown colocado na raiz de um site (/llms.txt) que dá aos grandes modelos de linguagem um mapa curto e curado das páginas que mais vale a pena ler. Foi proposto por Jeremy Howard, da Answer.AI, em 3 de setembro de 2024 e está documentado em llmstxt.org. É uma convenção da comunidade, não um padrão da IETF ou do W3C.
O Google ou o ChatGPT realmente leem meu llms.txt?
Em meados de 2026, nenhum grande provedor de LLM (OpenAI, Anthropic, Google, Perplexity) documenta publicamente que consome o llms.txt de terceiros em seu rastreador ou pipeline de inferência, e John Mueller, do Google, questionou publicamente seu valor como sinal de busca. A adoção do lado de quem publica é real e crescente; o consumo do lado dos fornecedores não está confirmado. Encare-o como um seguro barato e compatível com o futuro, não como um canal de tráfego garantido.
O llms.txt é a mesma coisa que o robots.txt?
Não. O robots.txt é um padrão de controle de acesso (IETF RFC 9309) que informa aos rastreadores o que eles podem buscar; o sitemap.xml lista o que existe para os motores de busca; o llms.txt cura o que vale a pena ler para um LLM. Eles são complementares — mantenha os três.
O que um site de comércio deve colocar no llms.txt?
Uma descrição de uma linha e, depois, links curados para as páginas de que um assistente precisa para responder às perguntas dos compradores: visões gerais de produtos e coleções, envio e devoluções, guias de tamanho ou de especificações, páginas de integração ou de padrões e páginas de políticas importantes. Cure por sinal, não por cobertura — deixe de fora carrinho, checkout, login e páginas rasas.

Mantenha-se atualizado sobre os padrões

Um aviso quando um padrão muda (ACP, UCP, AP2, MCP, x402). Sem spam.

Cancele a qualquer momento.