Un marchand sur quatre est fermé à un robot qui dit qui il est

Publié le . Chiffres calculés depuis le baromètre de préparation agentique, mesure du 2026-09-09.

En bref : 60/250 homes marchandes françaises et 61/250 américaines (24 % et 24 %) répondent HTTP 403 à un scanner qui se présente comme ACPInfoPublicSignalScanner/1.0 (+https://agenticcommerceprotocol.info/scan). En ajoutant délais dépassés, erreurs serveur, limitations de débit et redirections hors site, 84 boutiques françaises et 80 américaines sur 250 chacune sont fermées à ce robot. Le commerce agentique suppose qu’un agent puisse au moins lire la boutique ; pour un quart à un tiers des marchands les plus visités des deux pays, un agent inconnu ne le peut pas.

Ce que « fermé » veut dire ici

Le baromètre envoie une requête à la home résolue avec un user agent identifié et non navigateur, suit les redirections internes au site, et enregistre la réponse. Une boutique est comptée fermée quand la réponse n’est pas une page HTML en 2xx. Détail pour la France : 60 HTTP 403, 16 délais dépassés après dix secondes, 2 erreurs serveur ou limitations de débit, 4 redirections qui quittent le domaine du marchand. Pour les États-Unis : 61 HTTP 403, 2 délais dépassés, 14 erreurs serveur ou limitations, 2 redirections hors site. Rien n’est réessayé avec une identité de navigateur, aucune protection n’est contournée. C’est ce que voit un agent qui respecte les règles.

Où cela se produit

Par secteur, la part de boutiques fermées va en France de 7 % (Électronique) à 51 % (Mode). Aux États-Unis, de 11 % (Électronique) à 44 % (Généraliste).

SecteurFermées, FRFermées, US
Mode25/49 (51 %)14/44 (32 %)
Généraliste13/27 (48 %)11/25 (44 %)
Sport17/46 (37 %)21/49 (43 %)
Beauté11/40 (28 %)5/39 (13 %)
Maison9/38 (24 %)16/49 (33 %)
Bijoux et luxe8/34 (24 %)12/31 (39 %)
Électronique1/15 (7 %)1/9 (11 %)

Les secteurs sont les catégories Semrush Trending Websites dans lesquelles le marchand était classé (meilleur rang conservé).

Le fichier est public, les pages ne le sont pas

Le Robots Exclusion Protocol (RFC 9309) permet à un site de dire aux crawlers quels chemins ils peuvent récupérer. C’est une demande, pas un mur. Dans le panel, 20 marchands français et 13 américains servent un robots.txt parfaitement lisible puis répondent 403 sur la home elle-même. Les deux mécanismes vivent à des couches différentes : le fichier est servi par l’origine, le blocage vient d’une couche de gestion des bots placée devant. Un agent qui lit le fichier, le respecte, puis demande la page qu’il était autorisé à lire n’obtient toujours rien.

La même coupure apparaît avec UCP. sezane.com et backcountry.com bloquent la home et servent un profil de découverte valide à /.well-known/ucp : la porte de la négociation est ouverte, la vitrine est fermée. Une intégration au niveau plateforme peut passer par cette porte ; un agent qui commence par lire la page ne le peut pas.

Pourquoi cela compte plus que les décomptes de protocoles

Les signaux protocolaires du baromètre sont bas partout : 9 % et 16 % de profils UCP valides, 16 % et 28 % de vrais fichiers llms.txt. Ces chiffres peuvent monter vite, parce qu’une plateforme peut les publier pour des milliers de marchands d’un coup, comme Shopify l’a fait. La part de 403 est d’une autre nature. C’est un choix que la pile de sécurité de chaque marchand fait vis-à-vis de l’automatisation inconnue, et l’adoption d’un protocole ne le défait pas. Un marchand peut avoir un profil valide, des données produit exactes et un checkout documenté, et rester inatteignable pour tout agent qu’il n’a pas explicitement reconnu.

C’est là que les cadres de vérification des agents prennent leur place. Le Trusted Agent Protocol de Visa et les approches par signature décrites dans comment vérifier un agent IA existent précisément pour qu’un mur anti-bot laisse passer un agent connu tout en gardant les scrapers inconnus dehors. Tant qu’ils ne sont pas déployés des deux côtés, un 403 général est aussi un 403 pour les agents.

Ce qu’un marchand doit décider

  1. Savoir ce que votre couche anti-bot fait d’un user agent identifié non navigateur. Passez le scanner public sur votre propre home ; le résultat est la requête exacte envoyée par le baromètre.
  2. Décider explicitement quels agents vous voulez servir : aucun, les agents vérifiés seulement, ou tout agent qui s’identifie. Chaque réponse se défend ; la réponse par défaut n’est pas une décision.
  3. Si vous choisissez les agents vérifiés, documentez le chemin de vérification que vous supportez et gardez la surface de découverte (/.well-known/ucp, robots.txt, llms.txt) joignable même quand la vitrine est protégée, comme le font déjà les deux marchands cités.
  4. Si vous choisissez de servir les agents déclarés, mettez les user agents identifiés en liste blanche dans la couche anti-bot et limitez leur débit au lieu de les bloquer ; le baromètre compte aussi le 429 comme fermé, mais une limitation est au moins une conversation.

Limites

Une seule requête par marchand, à une date, depuis une adresse par pays. Certains 403 sont géographiques, certains ne se déclenchent qu’à la première visite, et une boutique qui répond 200 aujourd’hui peut être fermée demain après un changement de sécurité. Le baromètre rejouera les mêmes 500 adresses en octobre 2026 et publiera quelles boutiques se sont ouvertes ou fermées.

Questions

Que signifie « fermé aux robots » dans le baromètre ?
La home n’a pas renvoyé une page HTML en 2xx à un scanner qui s’identifie avec le user agent ACPInfoPublicSignalScanner/1.0 (+https://agenticcommerceprotocol.info/scan) : HTTP 403 dans la plupart des cas, un délai dépassé, une erreur 5xx ou 429, ou une redirection hors du domaine du marchand. Le baromètre ne réessaie jamais avec une identité de navigateur et ne contourne aucun mur anti-bot.
Bloquer les robots est-il une erreur ?
Pas forcément. La protection anti-bot défend contre le scraping, le bourrage d’identifiants et l’accaparement de stock, et un marchand peut légitimement réserver l’accès des agents à des agents vérifiés et sous contrat. L’enjeu est que le choix soit explicite : un marchand qui bloque tout robot inconnu doit avoir un autre chemin documenté (cadre de vérification, intégration plateforme, canal partenaire), sinon il est invisible pour tout agent qu’il n’a pas rencontré.
Une boutique peut-elle être bloquée et publier un profil UCP ?
Oui. sezane.com et backcountry.com renvoient 403 sur la home et un profil valide sur /.well-known/ucp. Les chemins de découverte et les pages de la boutique sont souvent protégés par des règles différentes.
Quel rôle joue robots.txt ?
robots.txt (RFC 9309) dit à un crawler ce qu’il peut récupérer ; il ne bloque rien par lui-même. 20 marchands français et 13 américains servent un robots.txt lisible tout en renvoyant 403 sur la home : le fichier est public, les pages ne le sont pas.