llms.txt per il commercio agentico: cos’è, se funziona e come pubblicarne uno

Pubblicato il . Ogni affermazione rimanda a una fonte primaria.

Risposta breve: llms.txt è un piccolo file Markdown nella radice del tuo sito (/llms.txt) che offre a un modello linguistico una mappa curata delle pagine più utili da leggere. È stato proposto da Jeremy Howard di Answer.AI il 3 settembre 2024 e risiede su llmstxt.org. Lo stato onesto nel 2026: pubblicarne uno è ormai comune ed economico, ma nessun grande fornitore di IA ha confermato pubblicamente di leggere il tuo file. Per un sito di commercio agentico, questo lo rende un’assicurazione a prova di futuro — un contratto stabile e leggibile dalle macchine che controlli tu — più che un canale di traffico garantito. Ecco cos’è, chi lo legge e come pubblicarne uno valido. Per il riferimento più approfondito, llmtxt.info mantiene una guida neutrale e con fonti su cos’è llms.txt.

Cos’è davvero llms.txt

L’argomentazione di Howard era semplice: un modello linguistico ha una finestra di contesto piccola rispetto a un intero sito web, quindi chiedergli di scansionare tutto per rispondere a una sola domanda è dispendioso e con perdite. I siti pubblicano già robots.txt per i crawler e sitemap.xml per i motori di ricerca; llms.txt propone una convenzione parallela mirata specificamente agli LLM. Il formato è volutamente minimale: un H1 con il nome del sito, un riassunto su una riga in una citazione a blocco, poi sezioni Markdown di link curati con brevi descrizioni. È pensato per l’inferenza — il momento in cui un utente chiede di te a un assistente — non per l’addestramento, ed è curato per il segnale, non per la copertura (Answer.AI, llmstxt.org).

Eccone uno reale — il file che questo stesso sito pubblica su /llms.txt, ridotto per brevità:

# Agentic Commerce Protocol Info

> Neutral, up-to-date reference comparing the open standards
> behind agentic commerce: ACP, UCP, AP2, MCP and x402.

## Standards
- [Agentic Commerce Protocol (ACP)](/standards/acp): OpenAI + Stripe checkout.
- [Universal Commerce Protocol (UCP)](/standards/ucp): Google + Shopify.
- [x402](/standards/x402): Coinbase HTTP-native stablecoin payments.

## Core pages
- [ACP vs UCP vs AP2 vs MCP vs x402](/compare/acp-vs-ap2-vs-mcp): comparison table.
- [How AI agents pay](/how-ai-agents-pay): the agentic payments stack.
Figura 1 — Un llms.txt dal vivo: H1, un riassunto in citazione a blocco, poi sezioni curate di link. Vedi il file completo su /llms.txt.

In cosa differisce da robots.txt e sitemap.xml

I tre file sono complementari, non intercambiabili. L’inquadramento più chiaro: robots.txt dice cosa un crawler può scaricare, sitemap.xml dice cosa esiste e llms.txt dice cosa vale la pena leggere. Solo i primi due sono standard formali. llmtxt.info tiene una ripartizione più completa di llms.txt vs robots.txt vs sitemap.xml.

FileDestinatariScopoÈ uno standard?
robots.txtCrawler webControllo dell’accesso (consenti / nega)Sì — IETF RFC 9309
sitemap.xmlMotori di ricercaScoperta — elenca ogni paginaSì — sitemaps.org
llms.txtAssistenti LLMCurazione — cosa leggere per primoNo — proposta della comunità
llms-full.txtAssistenti LLMIncorporazione — il contenuto effettivo in un unico fileNo — proposta della comunità

Fonti: IETF RFC 9309, llmstxt.org.

Funziona davvero? La risposta onesta, a due facce

Qui è dove la maggior parte degli articoli esagera. Il lato dell’offerta e il lato della domanda si muovono a velocità molto diverse, e confonderli è l’errore più comune in assoluto.

Lato offerta — reale e in crescitaLato domanda — non confermatoSiti che pubblicano /llms.txtAnthropic · Cloudflare · StripeVercel · Mintlify · Perplexity≈10% di 300k domini campionati↑ in adozioneFornitori IA che leggono il tuo fileDoc crawler OpenAI / Anthropic /Google / Perplexity: silenzioNessun impegno pubblico a consumarlo? non provato
Figura 2 — Pubblicare llms.txt è comune; che i fornitori consumino file di terze parti non è documentato. La cifra di adozione del ~10% proviene da un’analisi di 300.000 domini riportata da Search Engine Journal (nov 2025). llmtxt.info mantiene la risposta con fonti su se Google e ChatGPT lo usano.

Allora perché pubblicarne uno? Perché il costo è di pochi minuti e lo svantaggio è zero. Le piattaforme di documentazione lo generano già automaticamente; i framework di agenti e le pipeline RAG lo cercano sempre più spesso; e quando il consumo arriverà, un file curato e accurato è un contratto che già controlli. Per un brand di commercio che tiene anche a essere letto correttamente dagli agenti di shopping — l’argomento del nostro pezzo companion su come gli agenti IA trovano e leggono i tuoi prodotti — è un complemento a basso sforzo allo schema.org e a dati puliti renderizzati lato server.

Guarda: llms.txt vs robots.txt vs sitemap.xml

Il breve video esplicativo di Webflow è una chiara panoramica di cos’è il file, di come differisce dai due file con cui viene spesso confuso e di come pubblicarne uno.

Fonte: Webflow — “What Is an llms.txt file?” (canale ufficiale).

Come pubblicarne uno valido per un sito di commercio

L’intero esercizio è curazione. Elenca le 10–20 pagine di cui un assistente avrebbe bisogno per rispondere alla domanda reale di un acquirente, scrivi una riga pulita per ciascuna e lascia fuori tutto il resto.

  • Inizia dall’identità — un H1 con il tuo brand e una citazione a blocco di una frase su cosa vendi e a chi.
  • Raggruppa gli elementi essenziali — collezioni e prodotti di punta, spedizioni e resi, guide alle taglie/specifiche e pagine chiave delle policy, ciascuna come link con una breve nota.
  • Cura, non scaricare — ometti carrello, checkout, login, ricerca e pagine povere di contenuto. Il segnale batte la copertura.
  • Collega l’HTML canonico (o versioni .md pulite), mantienilo UTF-8 e leggero, e aggiornalo quando cambiano contenuti importanti.
  • Considera llms-full.txt solo se i testi del tuo catalogo sono abbastanza ridotti da essere incorporati in modo utile.
  • Valida prima di pubblicare così che un parser lo legga nel modo che intendi.

llmtxt.info pubblica una guida passo passo con modelli pronti da copiare, e puoi validare il tuo file rispetto alla specifica prima di distribuirlo.

Dove si colloca nello stack del commercio agentico

llms.txt è lo strato di leggibilità; i protocolli su questo sito sono lo strato di transazione. Abbina un file pulito al resto: leggi come gli agenti trovano e leggono i tuoi prodotti, confronta gli standard di pagamento e scopri come accettare i pagamenti degli agenti. La cronologia datata è nel changelog.

Domande frequenti

Cos’è llms.txt?
Un file Markdown collocato nella radice di un sito (/llms.txt) che fornisce ai modelli linguistici di grandi dimensioni una mappa breve e curata delle pagine più utili da leggere. È stato proposto da Jeremy Howard di Answer.AI il 3 settembre 2024 ed è documentato su llmstxt.org. È una convenzione della comunità, non uno standard IETF o W3C.
Google o ChatGPT leggono davvero il mio llms.txt?
A metà 2026, nessun grande fornitore di LLM (OpenAI, Anthropic, Google, Perplexity) documenta pubblicamente di consumare llms.txt di terze parti nel proprio crawler o nella propria pipeline di inferenza, e John Mueller di Google ne ha messo pubblicamente in dubbio il valore come segnale di ricerca. L’adozione dal lato della pubblicazione è reale e in crescita; il consumo dal lato dei fornitori non è confermato. Trattalo come un’assicurazione economica e a prova di futuro, non come un canale di traffico garantito.
llms.txt è la stessa cosa di robots.txt?
No. robots.txt è uno standard di controllo dell’accesso (IETF RFC 9309) che dice ai crawler cosa possono scaricare; sitemap.xml elenca ciò che esiste per i motori di ricerca; llms.txt cura ciò che vale la pena leggere per un LLM. Sono complementari — mantienili tutti e tre.
Cosa dovrebbe mettere un sito di commercio in llms.txt?
Una descrizione su una riga, poi link curati alle pagine di cui un assistente ha bisogno per rispondere alle domande degli acquirenti: panoramiche di prodotti e collezioni, spedizioni e resi, guide alle taglie o alle specifiche, pagine di integrazione o standard e pagine chiave delle policy. Cura per il segnale, non per la copertura — lascia fuori carrello, checkout, login e pagine povere di contenuto.

Resta aggiornato sugli standard

Un avviso quando uno standard cambia (ACP, UCP, AP2, MCP, x402). Niente spam.

Disiscrizione in qualsiasi momento.