Cloudflare et robots IA : le blocage par défaut qui peut vous rendre invisible
Le 1er juillet 2026, Cloudflare a annoncé qu'à partir du 15 septembre 2026, les robots d'IA qui servent à l'entraînement ou qui agissent pour un utilisateur (les « agents ») seront bloqués par défaut sur les pages avec publicité des nouveaux domaines. Les robots de recherche restent autorisés. Un simple réglage par défaut peut donc empêcher des assistants et des agents d'achat de lire votre site, sans que personne ne s'en aperçoive.
Ce qui a été annoncé
Cloudflare classe désormais les robots d'IA selon trois comportements, et chaque site peut choisir de les autoriser ou de les bloquer séparément. L'annonce a été publiée le 1er juillet 2026, pour le deuxième « Content Independence Day » de l'entreprise.
| Catégorie | Définition de Cloudflare | Réglage par défaut au 15 septembre |
|---|---|---|
| Search (recherche) | Collecte ou indexe votre contenu pour répondre plus tard à des questions | Autorisé |
| Agent | Agit, généralement en temps réel, pour le compte d'une personne | Bloqué sur les pages avec publicité |
| Training (entraînement) | Prend votre contenu pour entraîner ou ajuster un modèle | Bloqué sur les pages avec publicité |
Pour chaque catégorie, trois options existent : bloquer sur toutes les pages, bloquer seulement sur les pages qui affichent de la publicité, ou ne pas bloquer. Les nouveaux réglages par défaut s'appliquent aux nouveaux domaines ajoutés à Cloudflare à partir du 15 septembre, plan gratuit compris. Selon TechCrunch, ils concernent aussi les nouveaux sites des clients existants et les sites du plan gratuit. Les clients existants peuvent refuser ces réglages avant le 15 septembre.
Autres points importants :
- Les robots à usages multiples sont visés. Un robot qui fait à la fois de la recherche et de l'entraînement sera concerné par le blocage de l'entraînement. Cloudflare demande aux entreprises d'IA de séparer leurs robots en trois robots distincts avant le 15 septembre.
- Le statut « Verified » ne suffit plus. Un robot vérifié par Cloudflare n'est plus autorisé automatiquement : c'est la catégorie autorisée qui décide.
- Trois niveaux d'usage dans robots.txt :
immediate(pas de stockage ni de réutilisation),reference(indexer, citer un extrait et renvoyer un lien, le niveau par défaut) etfull(résumer et reproduire). - Pay Per Use. En plus de Pay Per Crawl, les éditeurs peuvent être payés quand leur contenu est utilisé par une IA, et pas seulement consulté. Premiers partenaires : Ceramic.ai et You.com.
Matthew Prince, PDG de Cloudflare, justifie ce choix ainsi : « Now that the majority of traffic on the Internet is non-human, we must go further and act faster » (maintenant que la majorité du trafic sur Internet n'est pas humain, nous devons aller plus loin et plus vite).
Ce que ça change pour votre visibilité dans les IA
Le risque principal est simple : un site peut devenir illisible pour certains assistants sans que son propriétaire l'ait décidé. Cloudflare protège une très grande partie du web, et beaucoup de petites entreprises utilisent son plan gratuit sans jamais ouvrir les réglages de sécurité.
Les réponses des moteurs IA restent possibles
Les robots de catégorie « Search » restent autorisés par défaut. Un moteur comme ChatGPT Search ou Perplexity peut donc continuer à indexer vos pages, à condition que son robot soit classé en « Search ». C'est ce qui permet d'être cité par ChatGPT, Perplexity et Claude.
Les agents, eux, peuvent être bloqués
Quand un utilisateur demande à un assistant d'aller lire une page précise, de comparer des offres ou d'acheter, c'est souvent un robot de type agent qui se connecte. Sur une page avec publicité, il sera bloqué par défaut sur les nouveaux domaines. Un agent IA qui ne peut pas lire votre page ne peut ni la recommander ni y acheter. Le débat sur l'accès des agents aux sites marchands est déjà ouvert, comme le montre l'affaire Amazon contre Perplexity.
Les robots mixtes sont le point à surveiller
Si une entreprise d'IA ne sépare pas ses robots avant le 15 septembre, son robot unique risque d'être bloqué dès que l'entraînement l'est. Cloudflare cite l'exemple de Googlebot. Certains observateurs estiment que cela pourrait gêner l'indexation par Google ; Cloudflare ne l'a pas confirmé.
Le fichier robots.txt ne suffit pas à savoir qui accède à votre site. Si Cloudflare bloque un robot avant qu'il n'atteigne votre serveur, vos règles robots.txt n'ont aucun effet pour lui.
Ce que vous pouvez faire dès maintenant
Vérifiez vos réglages Cloudflare avant le 15 septembre 2026, puis décidez robot par robot.
- Auditez vos réglages. Dans le tableau de bord Cloudflare, ouvrez les paramètres de sécurité de chaque domaine et regardez comment sont réglées les catégories Search, Agent et Training.
- Autorisez explicitement les robots des assistants. OAI-SearchBot et ChatGPT-User (OpenAI), PerplexityBot (Perplexity), Claude-SearchBot et Claude-User (Anthropic) : vérifiez qu'ils ne sont pas bloqués, ni par Cloudflare ni par votre robots.txt.
- Décidez de l'accès des agents à vos fiches produit. Si vous vendez en ligne, bloquer les agents peut vous priver de ventes ; les autoriser suppose d'accepter qu'un logiciel navigue pour un client.
- Lisez vos journaux de serveur. Comparez les visites des robots d'IA avant et après le 15 septembre pour repérer un blocage involontaire.
- Réservez Pay Per Use aux contenus éditoriaux. Pour un média ou un blog d'expertise, être payé à l'usage peut avoir un sens. Pour une fiche produit, la visibilité compte davantage.
Pour relier ces réglages à vos résultats, suivez aussi votre présence dans les réponses avec la méthode de notre guide pour mesurer la visibilité dans les moteurs IA.
Pour les e-commerçants : l'impact sur les fiches produit
Une fiche produit bloquée pour les agents ne peut pas être comparée ni achetée par un assistant, même si elle est bien indexée. Or les fiches produit affichent rarement de la publicité : le blocage par défaut vise d'abord les pages avec publicité. Les boutiques qui monétisent aussi un blog ou des guides d'achat avec des annonces doivent donc vérifier ces pages en priorité.
Dans tous les cas, gardez le prix, le stock et les caractéristiques dans le HTML de la page et dans vos données structurées. Pour vérifier ce que les robots des assistants peuvent réellement lire sur une fiche, vous pouvez utiliser l'application Référencement Génératif.
Questions fréquentes
Cloudflare bloque-t-il ChatGPT par défaut ?
Pas les robots de recherche. À partir du 15 septembre 2026, sur les nouveaux domaines, Cloudflare bloque par défaut les robots d'entraînement et les agents sur les pages avec publicité. Les robots de catégorie Search restent autorisés.
Qui est concerné par le blocage par défaut de Cloudflare ?
Les nouveaux domaines ajoutés à Cloudflare à partir du 15 septembre 2026, plan gratuit compris. Selon TechCrunch, les nouveaux sites des clients existants et les sites du plan gratuit sont aussi concernés. Les clients existants peuvent refuser ces réglages avant cette date.
Qu'est-ce que Pay Per Use de Cloudflare ?
C'est un système qui paie les éditeurs quand leur contenu est utilisé par une IA, par exemple dans une réponse, et pas seulement quand il est consulté. Il s'ajoute à Pay Per Crawl. Les premiers partenaires sont Ceramic.ai et You.com.
Faut-il bloquer les robots d'IA sur son site ?
Pas sans réfléchir. Bloquer l'entraînement peut se justifier, mais bloquer les robots de recherche et les agents vous retire des réponses des assistants. Décidez robot par robot, selon vos objectifs de visibilité.