El bloqueo de IA de Cloudflare ya detiene a todos menos a Google, Apple y Microsoft
Ha concluido la semana que Cloudflare fijó para convertir los bloqueos de entrenamiento de IA de sus clientes en preferencias de robots.txt. A Google, Apple y Microsoft ahora solo se les pide que respeten esas preferencias; los rastreadores de entrenamiento del resto siguen siendo detenidos en el borde de la red.
Vincent Jiang · 3 min read
El correo a clientes del 16 de septiembre de 2026 que envió Cloudflare anunciaba que los ajustes heredados de Block AI Bots migrarían automáticamente durante la semana siguiente, y que el interruptor desaparecería del panel de control una vez completada la migración 1. Esa semana ya ha transcurrido. Lo que los editores marcaban con un clic como un bloqueo es ahora, para las tres empresas que más importan, una nota de cortesía en un archivo de texto.
En qué se ha convertido un bloqueo
La correspondencia ya está fijada. El interruptor heredado de búsqueda acaba en Permitir; el de entrenamiento, en Disallow AI Training (prohibir el entrenamiento de la IA); y el de los agentes, en bloqueo en las páginas con anuncios 12. Disallow AI Training escribe una directiva de no entrenamiento en robots.txt mientras Googlebot, Applebot y Bingbot siguen descargando páginas, porque las tres empresas emplean un mismo rastreador para indexar la búsqueda y para entrenar sus modelos 12. El hueco que viene a cubrir es real: el 17% de los sitios de la red de Cloudflare bloquea el entrenamiento de alguna forma, menos del 1% bloquea los rastreadores de búsqueda, y la red se interpone ante más de un quinto de la web 13.
En la red de Cloudflare, bloquear el entrenamiento de IA es común; bloquear la búsqueda, raro
Data
| Value | |
|---|---|
| Sitios que bloquean el entrenamiento de IA | 17% |
| Sitios que bloquean los rastreadores de búsqueda | <1% |
| Web tras la red de Cloudflare | >20% |
La aplicación del bloqueo tiene ahora dos niveles
El ajuste todavía frena a alguien. Los rastreadores de entrenamiento de OpenAI, Anthropic, Meta y Amazon siguen bloqueados en seco en el borde de la red de Cloudflare 4. Google, Apple y Microsoft continúan descargando páginas bajo la etiqueta Accountable de Cloudflare, y lo que ocurra después con la página depende de que el operador respete el archivo 14. Microsoft ni siquiera podrá leer la nueva regla hasta que llegue su soporte de robots.txt, previsto para principios de 2027 12.
Accountable es una denominación propia de Cloudflare, no una certificación externa 4. La etiqueta se otorgó por capacidades que cada operador ya tiene, acompañadas de compromisos con plazo para lo que falta 12. Y en agosto la cuarta condición exigía a un operador «demostrar públicamente» que prohibir el entrenamiento no perjudica los resultados de búsqueda; la versión de septiembre se limita a pedir garantías 51.
El manual sigue prometiendo lo contrario
La propia documentación de Cloudflare, actualizada por última vez el 1 de julio de 2026 todavía sostiene que los rastreadores de propósito mixto «también quedarán bloqueados por todas las configuraciones para bloquear el entrenamiento de IA, incluida la opción heredada Block AI Bots» 6. Esa página enumera tres opciones para cada control: Permitir, Bloquear en páginas con anuncios y Bloquear 6. El producto distribuido incorpora una cuarta, Disallow AI Training, que el manual no menciona en ninguna parte 1. El comportamiento que se ha puesto en marcha es el inverso de la página que Cloudflare mantiene publicada.
La única manera de recuperar un bloqueo estricto es la opción Bloquear, que ahora deja a un sitio completamente fuera de la búsqueda de Google, Apple y Microsoft 12. Bloquear Bingbot saca a un sitio, de golpe, de Bing, Yahoo y Copilot 1.
El justificante no llega ahora: tardará semanas
El informe a nivel de URL —el mecanismo pensado para revelar qué páginas prohibidas se usaron de todos modos— llegará a Google dentro de unas semanas y a Apple el año que viene 124. Hasta que eso ocurra, las cuentas solo salen de una manera: los editores conservan su tráfico de búsqueda, los gigantes se quedan con el corpus, Cloudflare conserva a los dos bandos como clientes y los únicos rastreadores que siguen detenidos por la fuerza son los de los rivales de IA de los gigantes 4. Lo próximo son los resúmenes, con controles centralizados previstos para principios de 2027 13.
How this brief was made
01Gathered & sourced272 channels · 1,762 articles▾
Agents swept 272 channels and ingested 1,762 articles, then de-duplicated and ranked them for signal.
02Verified & cross-validated6 claims · 22 data feeds▾
Every one of 6 load-bearing claims was checked against primary sources, with 22 live data feeds reconciling the figures and charts.
- 1PPC Land, "Cloudflare drops planned Googlebot block for sites refusing AI training", 27 September 2026
- 2Search Engine Journal, Matt G. Southern, "Cloudflare Lets Sites Disallow AI Training Without Blocking Googlebot", 15 September 2026
- 3Best Media Info, "Cloudflare separates AI training opt-outs from search crawling for publishers", 16 September 2026
- 4heise online, Moritz Förster, "Google search yes, model training no: New Cloudflare rules", 18 September 2026
- 5Cloudflare blog, Jin-Hee Lee, "Say it once: introducing Bot Preference Sync", 21 August 2026, updated 15 September 2026
- 6Cloudflare documentation, "Block AI Bots", last updated 1 July 2026
03Reviewed & edited1 human editor▾
One editor read the draft against the evidence, tuned the framing, and signed off before it shipped.
Become a contributor
Reporting on the business of AI and want it read? We take pitches from outside contributors who bring primary sources and a number worth arguing about.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



