llms.txt pour le commerce agentique : ce que c’est, si ça marche, et comment en publier un

Publié le . Chaque affirmation renvoie à une source primaire.

Réponse courte : llms.txt est un petit fichier Markdown à la racine de votre site (/llms.txt) qui donne à un modèle de langage une carte curée des pages les plus utiles à lire. Il a été proposé par Jeremy Howard (Answer.AI) le 3 septembre 2024 et vit sur llmstxt.org. Le statut honnête en 2026 : en publier un est désormais courant et peu coûteux, mais aucun grand fournisseur d’IA n’a confirmé publiquement qu’il lit votre fichier. Pour un site de commerce agentique, c’est donc une assurance compatible avec l’avenir — un contrat stable et lisible par une machine que vous contrôlez — plutôt qu’un canal de trafic garanti. Voici ce que c’est, qui le lit, et comment en publier un bon. Pour la référence détaillée, llmtxt.info maintient un guide neutre et sourcé sur ce qu’est llms.txt.

Ce qu’est réellement llms.txt

L’argument de Howard est simple : un modèle de langage a une fenêtre de contexte restreinte par rapport à un site entier ; lui demander de tout crawler pour répondre à une seule question est coûteux et imprécis. Les sites publient déjà robots.txt pour les crawlers et sitemap.xml pour les moteurs ; llms.txt propose une convention parallèle visant spécifiquement les LLM. Le format est volontairement minimal : un H1 avec le nom du site, un résumé d’une ligne en citation, puis des sections Markdown de liens curés avec de courtes descriptions. Il est destiné à l’inférence — le moment où un utilisateur interroge un assistant à votre sujet — pas à l’entraînement, et il est curé pour le signal, pas la couverture (Answer.AI, llmstxt.org).

En voici un vrai — le fichier que ce site publie à /llms.txt, abrégé :

# Agentic Commerce Protocol Info

> Neutral, up-to-date reference comparing the open standards
> behind agentic commerce: ACP, UCP, AP2, MCP and x402.

## Standards
- [Agentic Commerce Protocol (ACP)](/standards/acp): OpenAI + Stripe checkout.
- [Universal Commerce Protocol (UCP)](/standards/ucp): Google + Shopify.
- [x402](/standards/x402): Coinbase HTTP-native stablecoin payments.

## Core pages
- [ACP vs UCP vs AP2 vs MCP vs x402](/compare/acp-vs-ap2-vs-mcp): comparison table.
- [How AI agents pay](/how-ai-agents-pay): the agentic payments stack.
Figure 1 — Un llms.txt en production : un H1, un résumé en citation, puis des sections de liens curés. Voir le fichier complet sur /llms.txt.

En quoi il diffère de robots.txt et sitemap.xml

Les trois fichiers sont complémentaires, pas interchangeables. La formulation la plus claire : robots.txt dit ce qu’un crawler peut récupérer, sitemap.xml dit ce qui existe, et llms.txt dit ce qui vaut la peine d’être lu. Seuls les deux premiers sont des standards formels. llmtxt.info tient un comparatif plus complet de llms.txt vs robots.txt vs sitemap.xml.

FichierPublicObjectifUn standard ?
robots.txtCrawlers webContrôle d’accès (autoriser / interdire)Oui — IETF RFC 9309
sitemap.xmlMoteurs de rechercheDécouverte — lister chaque pageOui — sitemaps.org
llms.txtAssistants LLMCuration — quoi lire d’abordNon — proposition communautaire
llms-full.txtAssistants LLMInlining — le contenu réel en un fichierNon — proposition communautaire

Sources : IETF RFC 9309, llmstxt.org.

Est-ce que ça marche vraiment ? La réponse honnête, en deux temps

C’est là que la plupart des articles survendent. L’offre et la demande avancent à des vitesses très différentes, et les confondre est l’erreur la plus courante.

Offre — réelle & croissanteDemande — non confirméeSites publiant /llms.txtAnthropic · Cloudflare · StripeVercel · Mintlify · Perplexity≈10 % de 300k domaines analysés↑ adoptentFournisseurs IA lisant votre fichierOpenAI / Anthropic / Google /Perplexity : docs crawler muettesAucun engagement public à consommer? non prouvé
Figure 2 — Publier un llms.txt est courant ; la consommation des fichiers tiers par les fournisseurs n’est pas documentée. Le chiffre d’≈10 % vient d’une analyse de 300 000 domaines rapportée par Search Engine Journal (nov. 2025). llmtxt.info tient la réponse sourcée à la question « Google et ChatGPT l’utilisent-ils ? ».

Alors pourquoi en publier un ? Parce que le coût se compte en minutes et que le risque est nul. Les plateformes de documentation le génèrent déjà automatiquement ; les frameworks d’agents et les pipelines RAG le cherchent de plus en plus ; et quand la consommation arrivera, un fichier curé et exact sera un contrat que vous contrôlez déjà. Pour une marque qui tient aussi à être correctement lue par les agents d’achat — le sujet de notre article compagnon sur comment les agents IA trouvent et lisent vos produits — c’est un complément peu coûteux au schema.org et à des données rendues côté serveur.

À regarder : llms.txt vs robots.txt vs sitemap.xml

L’explication courte de Webflow détaille clairement ce qu’est le fichier, en quoi il diffère des deux fichiers auxquels on le confond souvent, et comment en publier un.

Source : Webflow — « What Is an llms.txt file? » (chaîne officielle, en anglais).

Comment en publier un bon pour un site de commerce

Tout l’exercice est une curation. Listez les 10 à 20 pages qu’un assistant devrait lire pour répondre à une vraie question d’acheteur, écrivez une ligne propre pour chacune, et laissez le reste de côté.

  • Commencez par l’identité — un H1 avec votre marque et un résumé d’une phrase en citation : ce que vous vendez et à qui.
  • Regroupez l’essentiel — collections et produits phares, livraison & retours, guides de tailles/specs et pages de politiques clés, chacun avec un lien et une courte note.
  • Curez, n’entassez pas — omettez panier, checkout, connexion, recherche et pages pauvres. Le signal prime sur la couverture.
  • Liez le HTML canonique (ou des versions .md propres), gardez l’UTF-8 et un fichier léger, et mettez-le à jour quand un contenu important change.
  • Envisagez llms-full.txt seulement si vos contenus sont assez courts pour être inlinés utilement.
  • Validez avant de publier pour qu’un parseur le lise comme vous l’entendez.

llmtxt.info publie un guide pas à pas avec des templates prêts à copier, et vous pouvez valider votre fichier au regard de la spec avant de le déployer.

Où cela s’articule avec la pile du commerce agentique

llms.txt est la couche de lisibilité ; les protocoles de ce site sont la couche de transaction. Associez un fichier propre au reste : lisez comment les agents trouvent et lisent vos produits, comparez les standards de paiement, et voyez comment les agents IA paient.

Questions fréquentes

Qu’est-ce que llms.txt ?
Un fichier Markdown placé à la racine d’un site (/llms.txt) qui donne aux grands modèles de langage une carte courte et curée des pages les plus utiles à lire. Il a été proposé par Jeremy Howard (Answer.AI) le 3 septembre 2024 et est documenté sur llmstxt.org. C’est une convention communautaire, pas un standard IETF ou W3C.
Google ou ChatGPT lisent-ils vraiment mon llms.txt ?
À la mi-2026, aucun grand fournisseur de LLM (OpenAI, Anthropic, Google, Perplexity) ne documente publiquement la consommation des llms.txt tiers dans son crawler ou son pipeline d’inférence, et John Mueller (Google) a publiquement mis en doute sa valeur comme signal de recherche. L’adoption côté publication est réelle et croissante ; la consommation côté fournisseurs n’est pas confirmée. Traitez-le comme une assurance peu coûteuse et compatible avec l’avenir, pas comme un canal de trafic garanti.
llms.txt, est-ce la même chose que robots.txt ?
Non. robots.txt est un standard de contrôle d’accès (IETF RFC 9309) qui dit aux crawlers ce qu’ils peuvent récupérer ; sitemap.xml liste ce qui existe pour les moteurs ; llms.txt cure ce qui vaut la peine d’être lu pour un LLM. Ils sont complémentaires — gardez les trois.
Que mettre dans le llms.txt d’un site de commerce ?
Une description en une ligne, puis des liens curés vers les pages qu’un assistant doit lire pour répondre aux questions des acheteurs : aperçus produits et collections, livraison et retours, guides de tailles ou de specs, pages d’intégration/standards et pages de politiques clés. Curez pour le signal, pas la couverture — laissez de côté panier, checkout, connexion et pages pauvres.

Restez à jour sur les standards

Un point quand un standard bouge (ACP, UCP, AP2, MCP, x402). Pas de spam.

Désinscription à tout moment.