Cloudflare : le blocage IA ne bloque plus que tout le monde, sauf Google, Apple et Microsoft
Cloudflare s'était donné une semaine pour convertir les blocages d'entraînement IA de ses clients en préférences robots.txt. Cette semaine est écoulée : Google, Apple et Microsoft sont désormais simplement priés d'honorer ces préférences ; les robots d'entraînement de tous les autres acteurs restent, eux, bloqués à l'entrée du réseau.
Vincent Jiang · 3 min read
Cloudflare annonçait dans le courriel adressé à ses clients le 16 septembre 2026 que les anciens réglages « Block AI Bots » seraient migrés automatiquement au cours de la semaine suivante, et que l'interrupteur disparaîtrait du tableau de bord une fois la migration achevée 1. Cette semaine est écoulée. Ce que les éditeurs avaient coché en guise de blocage n'est désormais plus, pour les trois entreprises qui comptent le plus, qu'une note polie dans un fichier texte.
Ce qu'est devenu un blocage
La table de correspondance est fixée. Un ancien interrupteur atterrit sur « Search Allow », « Training Disallow AI Training » et Agents bloqués sur les pages avec publicité 12. « Disallow AI Training » inscrit dans le fichier robots.txt une directive interdisant l'entraînement, tandis que Googlebot, Applebot et Bingbot continuent d'aspirer les pages — parce que les trois entreprises utilisent un seul et même robot pour l'indexation de la recherche comme pour l'entraînement de leurs modèles 12. L'écart que cette option comble est bien réel : 17 % des sites du réseau de Cloudflare bloquent l'entraînement sous une forme ou une autre, moins de 1 % bloquent les robots de recherche, et le réseau se trouve devant plus d'un cinquième du web 13.
Sur le réseau de Cloudflare, bloquer l'entraînement de l'IA est courant, bloquer la recherche reste rare
Data
| Value | |
|---|---|
| Sites bloquant l'entraînement de l'IA | 17% |
| Sites bloquant les robots de recherche | <1% |
| Web derrière le réseau de Cloudflare | >20% |
Une application désormais à deux vitesses
Le réglage arrête encore quelqu'un. OpenAI, Anthropic, Meta et Amazon voient leurs robots d'entraînement stoppés net à l'entrée du réseau de Cloudflare 4. Google, Apple et Microsoft, eux, continuent d'aspirer les pages sous l'étiquette « Accountable » de Cloudflare ; ce qu'il advient ensuite de la page dépend du respect du fichier par l'opérateur 14. Microsoft ne peut même pas lire la nouvelle règle avant l'arrivée de sa prise en charge du robots.txt, prévue pour début 2027 12.
« Accountable » est une désignation maison, pas une certification externe 4. L'étiquette a été attribuée au vu des capacités dont chaque opérateur dispose déjà, assortie d'engagements datés pour le reste 12. En août, la quatrième condition exigeait d'un opérateur qu'il « démontre publiquement » que l'interdiction de l'entraînement de l'IA ne nuit pas aux résultats de recherche ; la version de septembre n'exige plus qu'une assurance 51.
La documentation promet toujours l'inverse
La propre documentation de Cloudflare, actualisée pour la dernière fois le 1er juillet 2026, assure toujours que les robots à usage mixte « seront également bloqués par toutes les configurations de blocage de l'entraînement de l'IA, y compris l'ancienne option Block AI Bots » 6. La page énumère trois options pour chaque réglage : « Allow », « Block on pages with ads » et « Block » 6. Le produit livré en compte une quatrième, « Disallow AI Training », que la documentation ne mentionne nulle part 1. Le comportement livré est l'inverse de la page que Cloudflare continue de publier.
Seul moyen de retrouver un blocage strict : « Block » — qui prive désormais un site de toute présence dans les recherches de Google, Apple et Microsoft 12. Bloquer Bingbot éjecte d'un seul coup un site de Bing, Yahoo et Copilot 1.
Le justificatif n'arrivera que dans quelques semaines
Le reporting au niveau des URL — mécanisme censé révéler quelles pages interdites ont été utilisées malgré tout — n'est attendu que dans quelques semaines chez Google, et l'année prochaine chez Apple 124. D'ici là, le bilan ne se lit que d'une façon : les éditeurs gardent leur trafic de recherche, les géants gardent le corpus, Cloudflare garde les deux camps pour clients ; et les seuls robots encore stoppés manu militari appartiennent aux concurrents IA des géants 4. Les résumés suivront, avec des réglages centralisés prévus pour début 2027 13.
How this brief was made
01Gathered & sourced272 channels · 1,762 articles▾
Agents swept 272 channels and ingested 1,762 articles, then de-duplicated and ranked them for signal.
02Verified & cross-validated6 claims · 22 data feeds▾
Every one of 6 load-bearing claims was checked against primary sources, with 22 live data feeds reconciling the figures and charts.
- 1PPC Land, "Cloudflare drops planned Googlebot block for sites refusing AI training", 27 September 2026
- 2Search Engine Journal, Matt G. Southern, "Cloudflare Lets Sites Disallow AI Training Without Blocking Googlebot", 15 September 2026
- 3Best Media Info, "Cloudflare separates AI training opt-outs from search crawling for publishers", 16 September 2026
- 4heise online, Moritz Förster, "Google search yes, model training no: New Cloudflare rules", 18 September 2026
- 5Cloudflare blog, Jin-Hee Lee, "Say it once: introducing Bot Preference Sync", 21 August 2026, updated 15 September 2026
- 6Cloudflare documentation, "Block AI Bots", last updated 1 July 2026
03Reviewed & edited1 human editor▾
One editor read the draft against the evidence, tuned the framing, and signed off before it shipped.
Become a contributor
Reporting on the business of AI and want it read? We take pitches from outside contributors who bring primary sources and a number worth arguing about.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



