llms.txt per il commercio agentico: cos’è, se funziona e come pubblicarne uno
Pubblicato il . Ogni affermazione rimanda a una fonte primaria.
Risposta breve: llms.txt è un piccolo file Markdown nella radice del tuo sito (/llms.txt) che offre a un modello linguistico una mappa curata delle pagine più utili da leggere. È stato proposto da Jeremy Howard di Answer.AI il 3 settembre 2024 e risiede su llmstxt.org. Lo stato onesto nel 2026: pubblicarne uno è ormai comune ed economico, ma nessun grande fornitore di IA ha confermato pubblicamente di leggere il tuo file. Per un sito di commercio agentico, questo lo rende un’assicurazione a prova di futuro — un contratto stabile e leggibile dalle macchine che controlli tu — più che un canale di traffico garantito. Ecco cos’è, chi lo legge e come pubblicarne uno valido. Per il riferimento più approfondito, llmtxt.info mantiene una guida neutrale e con fonti su cos’è llms.txt.
Cos’è davvero llms.txt
L’argomentazione di Howard era semplice: un modello linguistico ha una finestra di contesto piccola rispetto a un intero sito web, quindi chiedergli di scansionare tutto per rispondere a una sola domanda è dispendioso e con perdite. I siti pubblicano già robots.txt per i crawler e sitemap.xml per i motori di ricerca; llms.txt propone una convenzione parallela mirata specificamente agli LLM. Il formato è volutamente minimale: un H1 con il nome del sito, un riassunto su una riga in una citazione a blocco, poi sezioni Markdown di link curati con brevi descrizioni. È pensato per l’inferenza — il momento in cui un utente chiede di te a un assistente — non per l’addestramento, ed è curato per il segnale, non per la copertura (Answer.AI, llmstxt.org).
Eccone uno reale — il file che questo stesso sito pubblica su /llms.txt, ridotto per brevità:
# Agentic Commerce Protocol Info
> Neutral, up-to-date reference comparing the open standards
> behind agentic commerce: ACP, UCP, AP2, MCP and x402.
## Standards
- [Agentic Commerce Protocol (ACP)](/standards/acp): OpenAI + Stripe checkout.
- [Universal Commerce Protocol (UCP)](/standards/ucp): Google + Shopify.
- [x402](/standards/x402): Coinbase HTTP-native stablecoin payments.
## Core pages
- [ACP vs UCP vs AP2 vs MCP vs x402](/compare/acp-vs-ap2-vs-mcp): comparison table.
- [How AI agents pay](/how-ai-agents-pay): the agentic payments stack.llms.txt dal vivo: H1, un riassunto in citazione a blocco, poi sezioni curate di link. Vedi il file completo su /llms.txt.In cosa differisce da robots.txt e sitemap.xml
I tre file sono complementari, non intercambiabili. L’inquadramento più chiaro: robots.txt dice cosa un crawler può scaricare, sitemap.xml dice cosa esiste e llms.txt dice cosa vale la pena leggere. Solo i primi due sono standard formali. llmtxt.info tiene una ripartizione più completa di llms.txt vs robots.txt vs sitemap.xml.
| File | Destinatari | Scopo | È uno standard? |
|---|---|---|---|
robots.txt | Crawler web | Controllo dell’accesso (consenti / nega) | Sì — IETF RFC 9309 |
sitemap.xml | Motori di ricerca | Scoperta — elenca ogni pagina | Sì — sitemaps.org |
llms.txt | Assistenti LLM | Curazione — cosa leggere per primo | No — proposta della comunità |
llms-full.txt | Assistenti LLM | Incorporazione — il contenuto effettivo in un unico file | No — proposta della comunità |
Fonti: IETF RFC 9309, llmstxt.org.
Funziona davvero? La risposta onesta, a due facce
Qui è dove la maggior parte degli articoli esagera. Il lato dell’offerta e il lato della domanda si muovono a velocità molto diverse, e confonderli è l’errore più comune in assoluto.
llms.txt è comune; che i fornitori consumino file di terze parti non è documentato. La cifra di adozione del ~10% proviene da un’analisi di 300.000 domini riportata da Search Engine Journal (nov 2025). llmtxt.info mantiene la risposta con fonti su se Google e ChatGPT lo usano.Allora perché pubblicarne uno? Perché il costo è di pochi minuti e lo svantaggio è zero. Le piattaforme di documentazione lo generano già automaticamente; i framework di agenti e le pipeline RAG lo cercano sempre più spesso; e quando il consumo arriverà, un file curato e accurato è un contratto che già controlli. Per un brand di commercio che tiene anche a essere letto correttamente dagli agenti di shopping — l’argomento del nostro pezzo companion su come gli agenti IA trovano e leggono i tuoi prodotti — è un complemento a basso sforzo allo schema.org e a dati puliti renderizzati lato server.
Guarda: llms.txt vs robots.txt vs sitemap.xml
Il breve video esplicativo di Webflow è una chiara panoramica di cos’è il file, di come differisce dai due file con cui viene spesso confuso e di come pubblicarne uno.
Come pubblicarne uno valido per un sito di commercio
L’intero esercizio è curazione. Elenca le 10–20 pagine di cui un assistente avrebbe bisogno per rispondere alla domanda reale di un acquirente, scrivi una riga pulita per ciascuna e lascia fuori tutto il resto.
- Inizia dall’identità — un H1 con il tuo brand e una citazione a blocco di una frase su cosa vendi e a chi.
- Raggruppa gli elementi essenziali — collezioni e prodotti di punta, spedizioni e resi, guide alle taglie/specifiche e pagine chiave delle policy, ciascuna come link con una breve nota.
- Cura, non scaricare — ometti carrello, checkout, login, ricerca e pagine povere di contenuto. Il segnale batte la copertura.
- Collega l’HTML canonico (o versioni
.mdpulite), mantienilo UTF-8 e leggero, e aggiornalo quando cambiano contenuti importanti. - Considera
llms-full.txtsolo se i testi del tuo catalogo sono abbastanza ridotti da essere incorporati in modo utile. - Valida prima di pubblicare così che un parser lo legga nel modo che intendi.
llmtxt.info pubblica una guida passo passo con modelli pronti da copiare, e puoi validare il tuo file rispetto alla specifica prima di distribuirlo.
Dove si colloca nello stack del commercio agentico
llms.txt è lo strato di leggibilità; i protocolli su questo sito sono lo strato di transazione. Abbina un file pulito al resto: leggi come gli agenti trovano e leggono i tuoi prodotti, confronta gli standard di pagamento e scopri come accettare i pagamenti degli agenti. La cronologia datata è nel changelog.
Domande frequenti
Cos’è llms.txt?
/llms.txt) che fornisce ai modelli linguistici di grandi dimensioni una mappa breve e curata delle pagine più utili da leggere. È stato proposto da Jeremy Howard di Answer.AI il 3 settembre 2024 ed è documentato su llmstxt.org. È una convenzione della comunità, non uno standard IETF o W3C.Google o ChatGPT leggono davvero il mio llms.txt?
llms.txt di terze parti nel proprio crawler o nella propria pipeline di inferenza, e John Mueller di Google ne ha messo pubblicamente in dubbio il valore come segnale di ricerca. L’adozione dal lato della pubblicazione è reale e in crescita; il consumo dal lato dei fornitori non è confermato. Trattalo come un’assicurazione economica e a prova di futuro, non come un canale di traffico garantito.llms.txt è la stessa cosa di robots.txt?
robots.txt è uno standard di controllo dell’accesso (IETF RFC 9309) che dice ai crawler cosa possono scaricare; sitemap.xml elenca ciò che esiste per i motori di ricerca; llms.txt cura ciò che vale la pena leggere per un LLM. Sono complementari — mantienili tutti e tre.Cosa dovrebbe mettere un sito di commercio in llms.txt?
Resta aggiornato sugli standard
Un avviso quando uno standard cambia (ACP, UCP, AP2, MCP, x402). Niente spam.