llms.txt para el comercio agéntico: qué es, si funciona y cómo publicar uno

Publicado el . Cada afirmación enlaza a una fuente primaria.

Respuesta corta: llms.txt es un pequeño archivo Markdown en la raíz de tu sitio (/llms.txt) que entrega a un modelo de lenguaje un mapa curado de las páginas que más merece la pena leer. Fue propuesto por Jeremy Howard, de Answer.AI, el 3 de septiembre de 2024 y vive en llmstxt.org. El estado honesto en 2026: publicar uno es ahora común y barato, pero ningún proveedor importante de IA ha confirmado públicamente que lea tu archivo. Para un sitio de comercio agéntico, eso lo convierte en un seguro compatible con el futuro — un contrato estable y legible por máquina que tú controlas — en lugar de un canal de tráfico garantizado. Esto es lo que es, quién lo lee y cómo publicar uno bueno. Para la referencia más profunda, llmtxt.info mantiene una guía neutral y con fuentes sobre qué es llms.txt.

Qué es realmente llms.txt

El argumento de Howard era sencillo: un modelo de lenguaje tiene una ventana de contexto pequeña en comparación con un sitio web completo, así que pedirle que rastree todo para responder una pregunta es un derroche y conlleva pérdidas. Los sitios ya publican robots.txt para los rastreadores y sitemap.xml para los motores de búsqueda; llms.txt propone una convención paralela dirigida específicamente a los LLM. El formato es deliberadamente mínimo: un H1 con el nombre del sitio, un resumen de una línea en una cita en bloque y luego secciones Markdown de enlaces curados con descripciones breves. Está pensado para la inferencia — el momento en que un usuario pregunta a un asistente sobre ti — no para el entrenamiento, y se cura por señal, no por cobertura (Answer.AI, llmstxt.org).

Aquí tienes uno real — el archivo que este mismo sitio publica en /llms.txt, recortado por extensión:

# Agentic Commerce Protocol Info

> Neutral, up-to-date reference comparing the open standards
> behind agentic commerce: ACP, UCP, AP2, MCP and x402.

## Standards
- [Agentic Commerce Protocol (ACP)](/standards/acp): OpenAI + Stripe checkout.
- [Universal Commerce Protocol (UCP)](/standards/ucp): Google + Shopify.
- [x402](/standards/x402): Coinbase HTTP-native stablecoin payments.

## Core pages
- [ACP vs UCP vs AP2 vs MCP vs x402](/compare/acp-vs-ap2-vs-mcp): comparison table.
- [How AI agents pay](/how-ai-agents-pay): the agentic payments stack.
Figura 1 — Un llms.txt en vivo: H1, un resumen en cita en bloque y luego secciones curadas de enlaces. Mira el archivo completo en /llms.txt.

En qué se diferencia de robots.txt y sitemap.xml

Los tres archivos son complementarios, no intercambiables. El planteamiento más claro: robots.txt dice qué puede descargar un rastreador, sitemap.xml dice qué existe y llms.txt dice qué merece la pena leer. Solo los dos primeros son estándares formales. llmtxt.info mantiene un desglose más completo de llms.txt frente a robots.txt frente a sitemap.xml.

ArchivoAudienciaPropósito¿Es un estándar?
robots.txtRastreadores webControl de acceso (permitir / denegar)Sí — IETF RFC 9309
sitemap.xmlMotores de búsquedaDescubrimiento — lista todas las páginasSí — sitemaps.org
llms.txtAsistentes LLMCuración — qué leer primeroNo — propuesta comunitaria
llms-full.txtAsistentes LLMInclusión — el contenido real en un solo archivoNo — propuesta comunitaria

Fuentes: IETF RFC 9309, llmstxt.org.

¿Funciona de verdad? La respuesta honesta y de dos caras

Aquí es donde la mayoría de los artículos exageran. El lado de la oferta y el lado de la demanda se mueven a velocidades muy distintas, y confundirlos es el error más común de todos.

Lado de la oferta — real y crecienteLado de la demanda — sin confirmarSitios que publican /llms.txtAnthropic · Cloudflare · StripeVercel · Mintlify · Perplexity≈10% de 300 000 dominios muestreados↑ adoptandoProveedores de IA que leen tu archivoOpenAI / Anthropic / Google /docs de rastreadores de Perplexity: en silencioSin compromiso público de consumirlo? sin probar
Figura 2 — Publicar llms.txt es común; que los proveedores consuman archivos de terceros no está documentado. La cifra de adopción del ~10% procede de un análisis de 300 000 dominios publicado por Search Engine Journal (nov. 2025). llmtxt.info mantiene la respuesta con fuentes a si Google y ChatGPT lo usan.

Entonces, ¿por qué publicar uno? Porque el coste son minutos y la desventaja es cero. Las plataformas de documentación ya lo generan automáticamente; los frameworks de agentes y los pipelines RAG lo buscan cada vez más; y cuando el consumo llegue, un archivo curado y preciso es un contrato que ya controlas. Para una marca de comercio a la que también le importa ser leída correctamente por los agentes de compra — el tema de nuestro artículo complementario sobre cómo los agentes de IA encuentran y leen tus productos — es un complemento de bajo esfuerzo a schema.org y a unos datos limpios renderizados en el servidor.

Míralo: llms.txt frente a robots.txt frente a sitemap.xml

El breve explicativo de Webflow es un recorrido claro de qué es el archivo, en qué se diferencia de los dos archivos con los que suele confundirse y cómo publicar uno.

Fuente: Webflow — “What Is an llms.txt file?” (canal oficial).

Cómo publicar uno bueno para un sitio de comercio

Todo el ejercicio es curación. Enumera las 10–20 páginas que un asistente necesitaría para responder la pregunta real de un comprador, escribe una línea limpia por cada una y deja todo lo demás fuera.

  • Empieza por la identidad — un H1 con tu marca y una cita en bloque de una frase sobre qué vendes y a quién.
  • Agrupa lo esencial — colecciones y productos estrella, envíos y devoluciones, guías de tallas/especificaciones y páginas de políticas clave, cada una como un enlace con una nota breve.
  • Cura, no vacíes — omite el carrito, el pago, el inicio de sesión, la búsqueda y las páginas con poco contenido. La señal supera a la cobertura.
  • Enlaza el HTML canónico (o versiones .md limpias), mantenlo en UTF-8 y ligero, y actualízalo cuando cambie contenido importante.
  • Considera llms-full.txt solo si el texto de tu catálogo es lo bastante pequeño como para incluirlo de forma útil.
  • Valídalo antes de publicarlo para que un parser lo lea como pretendes.

llmtxt.info publica una guía paso a paso con plantillas para copiar y pegar, y puedes validar tu archivo frente a la especificación antes de desplegarlo.

Cómo encaja con la pila del comercio agéntico

llms.txt es la capa de legibilidad; los protocolos de este sitio son la capa de transacción. Combina un archivo limpio con el resto: lee cómo los agentes encuentran y leen tus productos, compara los estándares de pago y mira cómo aceptar pagos de agentes. La cronología fechada está en el registro de cambios.

Preguntas frecuentes

¿Qué es llms.txt?
Un archivo Markdown colocado en la raíz de un sitio (/llms.txt) que ofrece a los grandes modelos de lenguaje un mapa breve y curado de las páginas que más merece la pena leer. Fue propuesto por Jeremy Howard, de Answer.AI, el 3 de septiembre de 2024 y está documentado en llmstxt.org. Es una convención comunitaria, no un estándar de la IETF ni del W3C.
¿Google o ChatGPT leen realmente mi llms.txt?
A mediados de 2026, ningún proveedor importante de LLM (OpenAI, Anthropic, Google, Perplexity) documenta públicamente que consuma llms.txt de terceros en su rastreador o en su flujo de inferencia, y John Mueller, de Google, ha cuestionado públicamente su valor como señal de búsqueda. La adopción en el lado de la publicación es real y va en aumento; el consumo en el lado del proveedor no está confirmado. Trátalo como un seguro barato y compatible con el futuro, no como un canal de tráfico garantizado.
¿llms.txt es lo mismo que robots.txt?
No. robots.txt es un estándar de control de acceso (IETF RFC 9309) que indica a los rastreadores qué pueden descargar; sitemap.xml lista lo que existe para los motores de búsqueda; llms.txt cura lo que merece la pena leer para un LLM. Son complementarios — conserva los tres.
¿Qué debería poner un sitio de comercio en llms.txt?
Una descripción de una línea y luego enlaces curados a las páginas que un asistente necesita para responder preguntas de los compradores: resúmenes de productos y colecciones, envíos y devoluciones, guías de tallas o especificaciones, páginas de integración o estándares y páginas de políticas clave. Cura por señal, no por cobertura — deja fuera el carrito, el pago, el inicio de sesión y las páginas con poco contenido.

Manténgase al día sobre los estándares

Un aviso cuando un estándar cambia (ACP, UCP, AP2, MCP, x402). Sin spam.

Cancele su suscripción en cualquier momento.