llms.txt para el comercio agéntico: qué es, si funciona y cómo publicar uno
Publicado el . Cada afirmación enlaza a una fuente primaria.
Respuesta corta: llms.txt es un pequeño archivo Markdown en la raíz de tu sitio (/llms.txt) que entrega a un modelo de lenguaje un mapa curado de las páginas que más merece la pena leer. Fue propuesto por Jeremy Howard, de Answer.AI, el 3 de septiembre de 2024 y vive en llmstxt.org. El estado honesto en 2026: publicar uno es ahora común y barato, pero ningún proveedor importante de IA ha confirmado públicamente que lea tu archivo. Para un sitio de comercio agéntico, eso lo convierte en un seguro compatible con el futuro — un contrato estable y legible por máquina que tú controlas — en lugar de un canal de tráfico garantizado. Esto es lo que es, quién lo lee y cómo publicar uno bueno. Para la referencia más profunda, llmtxt.info mantiene una guía neutral y con fuentes sobre qué es llms.txt.
Qué es realmente llms.txt
El argumento de Howard era sencillo: un modelo de lenguaje tiene una ventana de contexto pequeña en comparación con un sitio web completo, así que pedirle que rastree todo para responder una pregunta es un derroche y conlleva pérdidas. Los sitios ya publican robots.txt para los rastreadores y sitemap.xml para los motores de búsqueda; llms.txt propone una convención paralela dirigida específicamente a los LLM. El formato es deliberadamente mínimo: un H1 con el nombre del sitio, un resumen de una línea en una cita en bloque y luego secciones Markdown de enlaces curados con descripciones breves. Está pensado para la inferencia — el momento en que un usuario pregunta a un asistente sobre ti — no para el entrenamiento, y se cura por señal, no por cobertura (Answer.AI, llmstxt.org).
Aquí tienes uno real — el archivo que este mismo sitio publica en /llms.txt, recortado por extensión:
# Agentic Commerce Protocol Info
> Neutral, up-to-date reference comparing the open standards
> behind agentic commerce: ACP, UCP, AP2, MCP and x402.
## Standards
- [Agentic Commerce Protocol (ACP)](/standards/acp): OpenAI + Stripe checkout.
- [Universal Commerce Protocol (UCP)](/standards/ucp): Google + Shopify.
- [x402](/standards/x402): Coinbase HTTP-native stablecoin payments.
## Core pages
- [ACP vs UCP vs AP2 vs MCP vs x402](/compare/acp-vs-ap2-vs-mcp): comparison table.
- [How AI agents pay](/how-ai-agents-pay): the agentic payments stack.llms.txt en vivo: H1, un resumen en cita en bloque y luego secciones curadas de enlaces. Mira el archivo completo en /llms.txt.En qué se diferencia de robots.txt y sitemap.xml
Los tres archivos son complementarios, no intercambiables. El planteamiento más claro: robots.txt dice qué puede descargar un rastreador, sitemap.xml dice qué existe y llms.txt dice qué merece la pena leer. Solo los dos primeros son estándares formales. llmtxt.info mantiene un desglose más completo de llms.txt frente a robots.txt frente a sitemap.xml.
| Archivo | Audiencia | Propósito | ¿Es un estándar? |
|---|---|---|---|
robots.txt | Rastreadores web | Control de acceso (permitir / denegar) | Sí — IETF RFC 9309 |
sitemap.xml | Motores de búsqueda | Descubrimiento — lista todas las páginas | Sí — sitemaps.org |
llms.txt | Asistentes LLM | Curación — qué leer primero | No — propuesta comunitaria |
llms-full.txt | Asistentes LLM | Inclusión — el contenido real en un solo archivo | No — propuesta comunitaria |
Fuentes: IETF RFC 9309, llmstxt.org.
¿Funciona de verdad? La respuesta honesta y de dos caras
Aquí es donde la mayoría de los artículos exageran. El lado de la oferta y el lado de la demanda se mueven a velocidades muy distintas, y confundirlos es el error más común de todos.
llms.txt es común; que los proveedores consuman archivos de terceros no está documentado. La cifra de adopción del ~10% procede de un análisis de 300 000 dominios publicado por Search Engine Journal (nov. 2025). llmtxt.info mantiene la respuesta con fuentes a si Google y ChatGPT lo usan.Entonces, ¿por qué publicar uno? Porque el coste son minutos y la desventaja es cero. Las plataformas de documentación ya lo generan automáticamente; los frameworks de agentes y los pipelines RAG lo buscan cada vez más; y cuando el consumo llegue, un archivo curado y preciso es un contrato que ya controlas. Para una marca de comercio a la que también le importa ser leída correctamente por los agentes de compra — el tema de nuestro artículo complementario sobre cómo los agentes de IA encuentran y leen tus productos — es un complemento de bajo esfuerzo a schema.org y a unos datos limpios renderizados en el servidor.
Míralo: llms.txt frente a robots.txt frente a sitemap.xml
El breve explicativo de Webflow es un recorrido claro de qué es el archivo, en qué se diferencia de los dos archivos con los que suele confundirse y cómo publicar uno.
Cómo publicar uno bueno para un sitio de comercio
Todo el ejercicio es curación. Enumera las 10–20 páginas que un asistente necesitaría para responder la pregunta real de un comprador, escribe una línea limpia por cada una y deja todo lo demás fuera.
- Empieza por la identidad — un H1 con tu marca y una cita en bloque de una frase sobre qué vendes y a quién.
- Agrupa lo esencial — colecciones y productos estrella, envíos y devoluciones, guías de tallas/especificaciones y páginas de políticas clave, cada una como un enlace con una nota breve.
- Cura, no vacíes — omite el carrito, el pago, el inicio de sesión, la búsqueda y las páginas con poco contenido. La señal supera a la cobertura.
- Enlaza el HTML canónico (o versiones
.mdlimpias), mantenlo en UTF-8 y ligero, y actualízalo cuando cambie contenido importante. - Considera
llms-full.txtsolo si el texto de tu catálogo es lo bastante pequeño como para incluirlo de forma útil. - Valídalo antes de publicarlo para que un parser lo lea como pretendes.
llmtxt.info publica una guía paso a paso con plantillas para copiar y pegar, y puedes validar tu archivo frente a la especificación antes de desplegarlo.
Cómo encaja con la pila del comercio agéntico
llms.txt es la capa de legibilidad; los protocolos de este sitio son la capa de transacción. Combina un archivo limpio con el resto: lee cómo los agentes encuentran y leen tus productos, compara los estándares de pago y mira cómo aceptar pagos de agentes. La cronología fechada está en el registro de cambios.
Preguntas frecuentes
¿Qué es llms.txt?
/llms.txt) que ofrece a los grandes modelos de lenguaje un mapa breve y curado de las páginas que más merece la pena leer. Fue propuesto por Jeremy Howard, de Answer.AI, el 3 de septiembre de 2024 y está documentado en llmstxt.org. Es una convención comunitaria, no un estándar de la IETF ni del W3C.¿Google o ChatGPT leen realmente mi llms.txt?
llms.txt de terceros en su rastreador o en su flujo de inferencia, y John Mueller, de Google, ha cuestionado públicamente su valor como señal de búsqueda. La adopción en el lado de la publicación es real y va en aumento; el consumo en el lado del proveedor no está confirmado. Trátalo como un seguro barato y compatible con el futuro, no como un canal de tráfico garantizado.¿llms.txt es lo mismo que robots.txt?
robots.txt es un estándar de control de acceso (IETF RFC 9309) que indica a los rastreadores qué pueden descargar; sitemap.xml lista lo que existe para los motores de búsqueda; llms.txt cura lo que merece la pena leer para un LLM. Son complementarios — conserva los tres.¿Qué debería poner un sitio de comercio en llms.txt?
Manténgase al día sobre los estándares
Un aviso cuando un estándar cambia (ACP, UCP, AP2, MCP, x402). Sin spam.