llms.txt pour le commerce agentique : ce que c’est, si ça marche, et comment en publier un
Publié le . Chaque affirmation renvoie à une source primaire.
Réponse courte : llms.txt est un petit fichier Markdown à la racine de votre site (/llms.txt) qui donne à un modèle de langage une carte curée des pages les plus utiles à lire. Il a été proposé par Jeremy Howard (Answer.AI) le 3 septembre 2024 et vit sur llmstxt.org. Le statut honnête en 2026 : en publier un est désormais courant et peu coûteux, mais aucun grand fournisseur d’IA n’a confirmé publiquement qu’il lit votre fichier. Pour un site de commerce agentique, c’est donc une assurance compatible avec l’avenir — un contrat stable et lisible par une machine que vous contrôlez — plutôt qu’un canal de trafic garanti. Voici ce que c’est, qui le lit, et comment en publier un bon. Pour la référence détaillée, llmtxt.info maintient un guide neutre et sourcé sur ce qu’est llms.txt.
Ce qu’est réellement llms.txt
L’argument de Howard est simple : un modèle de langage a une fenêtre de contexte restreinte par rapport à un site entier ; lui demander de tout crawler pour répondre à une seule question est coûteux et imprécis. Les sites publient déjà robots.txt pour les crawlers et sitemap.xml pour les moteurs ; llms.txt propose une convention parallèle visant spécifiquement les LLM. Le format est volontairement minimal : un H1 avec le nom du site, un résumé d’une ligne en citation, puis des sections Markdown de liens curés avec de courtes descriptions. Il est destiné à l’inférence — le moment où un utilisateur interroge un assistant à votre sujet — pas à l’entraînement, et il est curé pour le signal, pas la couverture (Answer.AI, llmstxt.org).
En voici un vrai — le fichier que ce site publie à /llms.txt, abrégé :
# Agentic Commerce Protocol Info
> Neutral, up-to-date reference comparing the open standards
> behind agentic commerce: ACP, UCP, AP2, MCP and x402.
## Standards
- [Agentic Commerce Protocol (ACP)](/standards/acp): OpenAI + Stripe checkout.
- [Universal Commerce Protocol (UCP)](/standards/ucp): Google + Shopify.
- [x402](/standards/x402): Coinbase HTTP-native stablecoin payments.
## Core pages
- [ACP vs UCP vs AP2 vs MCP vs x402](/compare/acp-vs-ap2-vs-mcp): comparison table.
- [How AI agents pay](/how-ai-agents-pay): the agentic payments stack.llms.txt en production : un H1, un résumé en citation, puis des sections de liens curés. Voir le fichier complet sur /llms.txt.En quoi il diffère de robots.txt et sitemap.xml
Les trois fichiers sont complémentaires, pas interchangeables. La formulation la plus claire : robots.txt dit ce qu’un crawler peut récupérer, sitemap.xml dit ce qui existe, et llms.txt dit ce qui vaut la peine d’être lu. Seuls les deux premiers sont des standards formels. llmtxt.info tient un comparatif plus complet de llms.txt vs robots.txt vs sitemap.xml.
| Fichier | Public | Objectif | Un standard ? |
|---|---|---|---|
robots.txt | Crawlers web | Contrôle d’accès (autoriser / interdire) | Oui — IETF RFC 9309 |
sitemap.xml | Moteurs de recherche | Découverte — lister chaque page | Oui — sitemaps.org |
llms.txt | Assistants LLM | Curation — quoi lire d’abord | Non — proposition communautaire |
llms-full.txt | Assistants LLM | Inlining — le contenu réel en un fichier | Non — proposition communautaire |
Sources : IETF RFC 9309, llmstxt.org.
Est-ce que ça marche vraiment ? La réponse honnête, en deux temps
C’est là que la plupart des articles survendent. L’offre et la demande avancent à des vitesses très différentes, et les confondre est l’erreur la plus courante.
llms.txt est courant ; la consommation des fichiers tiers par les fournisseurs n’est pas documentée. Le chiffre d’≈10 % vient d’une analyse de 300 000 domaines rapportée par Search Engine Journal (nov. 2025). llmtxt.info tient la réponse sourcée à la question « Google et ChatGPT l’utilisent-ils ? ».Alors pourquoi en publier un ? Parce que le coût se compte en minutes et que le risque est nul. Les plateformes de documentation le génèrent déjà automatiquement ; les frameworks d’agents et les pipelines RAG le cherchent de plus en plus ; et quand la consommation arrivera, un fichier curé et exact sera un contrat que vous contrôlez déjà. Pour une marque qui tient aussi à être correctement lue par les agents d’achat — le sujet de notre article compagnon sur comment les agents IA trouvent et lisent vos produits — c’est un complément peu coûteux au schema.org et à des données rendues côté serveur.
À regarder : llms.txt vs robots.txt vs sitemap.xml
L’explication courte de Webflow détaille clairement ce qu’est le fichier, en quoi il diffère des deux fichiers auxquels on le confond souvent, et comment en publier un.
Comment en publier un bon pour un site de commerce
Tout l’exercice est une curation. Listez les 10 à 20 pages qu’un assistant devrait lire pour répondre à une vraie question d’acheteur, écrivez une ligne propre pour chacune, et laissez le reste de côté.
- Commencez par l’identité — un H1 avec votre marque et un résumé d’une phrase en citation : ce que vous vendez et à qui.
- Regroupez l’essentiel — collections et produits phares, livraison & retours, guides de tailles/specs et pages de politiques clés, chacun avec un lien et une courte note.
- Curez, n’entassez pas — omettez panier, checkout, connexion, recherche et pages pauvres. Le signal prime sur la couverture.
- Liez le HTML canonique (ou des versions
.mdpropres), gardez l’UTF-8 et un fichier léger, et mettez-le à jour quand un contenu important change. - Envisagez
llms-full.txtseulement si vos contenus sont assez courts pour être inlinés utilement. - Validez avant de publier pour qu’un parseur le lise comme vous l’entendez.
llmtxt.info publie un guide pas à pas avec des templates prêts à copier, et vous pouvez valider votre fichier au regard de la spec avant de le déployer.
Où cela s’articule avec la pile du commerce agentique
llms.txt est la couche de lisibilité ; les protocoles de ce site sont la couche de transaction. Associez un fichier propre au reste : lisez comment les agents trouvent et lisent vos produits, comparez les standards de paiement, et voyez comment les agents IA paient.
Questions fréquentes
Qu’est-ce que llms.txt ?
/llms.txt) qui donne aux grands modèles de langage une carte courte et curée des pages les plus utiles à lire. Il a été proposé par Jeremy Howard (Answer.AI) le 3 septembre 2024 et est documenté sur llmstxt.org. C’est une convention communautaire, pas un standard IETF ou W3C.Google ou ChatGPT lisent-ils vraiment mon llms.txt ?
llms.txt tiers dans son crawler ou son pipeline d’inférence, et John Mueller (Google) a publiquement mis en doute sa valeur comme signal de recherche. L’adoption côté publication est réelle et croissante ; la consommation côté fournisseurs n’est pas confirmée. Traitez-le comme une assurance peu coûteuse et compatible avec l’avenir, pas comme un canal de trafic garanti.llms.txt, est-ce la même chose que robots.txt ?
robots.txt est un standard de contrôle d’accès (IETF RFC 9309) qui dit aux crawlers ce qu’ils peuvent récupérer ; sitemap.xml liste ce qui existe pour les moteurs ; llms.txt cure ce qui vaut la peine d’être lu pour un LLM. Ils sont complémentaires — gardez les trois.Que mettre dans le llms.txt d’un site de commerce ?
Restez à jour sur les standards
Un point quand un standard bouge (ACP, UCP, AP2, MCP, x402). Pas de spam.