Bloqueio de IA da Cloudflare agora barra todos, menos Google, Apple e Microsoft
A semana que a Cloudflare havia estipulado para converter os bloqueios de treinamento de IA de seus clientes em preferências no robots.txt chegou ao fim. Google, Apple e Microsoft agora apenas são instadas a respeitar essas preferências; os rastreadores de treinamento (crawlers) das demais empresas continuam barrados na borda da rede.
Vincent Jiang · 3 min read
Cloudflare avisou, em e-mail enviado a clientes em 16 de setembro de 2026, que as antigas configurações Block AI Bots seriam migradas automaticamente ao longo da semana seguinte — e que o interruptor desapareceria do painel de controle assim que a migração terminasse 1. Essa semana terminou. O que para os editores era um clique de bloqueio agora é, para as três empresas que mais importam, um bilhete educado em um arquivo de texto.
No que o bloqueio se transformou
O mapeamento está definido. O interruptor antigo resulta em Search Allow, Training Disallow AI Training e Agente bloqueado em páginas com anúncios 12. A opção Disallow AI Training grava no robots.txt uma diretiva de não treinamento, mas Googlebot, Applebot e Bingbot seguem buscando páginas, porque as três empresas usam um único rastreador tanto para a indexação da busca quanto para o treinamento de modelos 12. A lacuna que a opção ataca é real: 17% dos sites na rede da Cloudflare bloqueiam treinamento de alguma forma, menos de 1% bloqueiam rastreadores de busca, e a rede da empresa está à frente de mais de um quinto da web 13.
Bloquear treinamento de IA é comum na rede da Cloudflare; bloquear busca é raro
Data
| Value | |
|---|---|
| Sites que bloqueiam treinamento de IA | 17% |
| Sites que bloqueiam rastreadores de busca | <1% |
| Web atrás da rede da Cloudflare | >20% |
A aplicação das regras agora tem dois níveis
O ajuste ainda barra alguém. Os rastreadores de treinamento da OpenAI, da Anthropic, da Meta e da Amazon são bloqueados sem exceção na borda da rede da Cloudflare 4. Google, Apple e Microsoft continuam buscando páginas sob o selo Accountable da Cloudflare, e o que acontece com a página depois depende de o operador honrar o arquivo 14. A Microsoft nem sequer consegue ler a nova regra enquanto não chega seu suporte a robots.txt, previsto para o início de 2027 12.
Accountable é uma designação da própria Cloudflare, não uma certificação externa 4. O selo foi concedido com base em capacidades que cada operador já tem, combinadas com compromissos com prazo definido para o restante 12. E, em agosto, a quarta condição exigia que o operador "mostrasse publicamente" que vetar o treinamento não prejudica os resultados de busca; a versão de setembro apenas pede garantias 51.
O manual ainda promete o contrário
A documentação da própria Cloudflare, atualizada pela última vez em 1º de julho de 2026, ainda diz que rastreadores que combinam finalidades "também serão bloqueados por todas as configurações de bloqueio de treinamento de IA, incluindo a antiga opção Block AI Bots" 6. A página lista três opções para cada controle: Allow, Block on pages with ads e Block 6. O produto lançado traz uma quarta opção, Disallow AI Training, que o manual nunca menciona 1. O comportamento entregue aos clientes é o inverso da página que a Cloudflare continua publicando.
O único caminho de volta a um bloqueio rígido é a opção Block, que agora corta por completo um site das buscas do Google, da Apple e da Microsoft 12. Bloquear o Bingbot tira um site do Bing, do Yahoo e do Copilot de uma só vez 1.
O comprovante chega em semanas, não agora
O relatório em nível de URL, mecanismo destinado a revelar quais páginas vetadas foram usadas mesmo assim, ainda leva semanas para chegar no Google e está previsto para o ano que vem na Apple 124. Até lá, a conta fecha de um só jeito: os editores ficam com o tráfego de busca, os gigantes ficam com o corpus, a Cloudflare fica com os dois lados como clientes — e os únicos rastreadores ainda barrados pela força pertencem aos rivais de IA dos gigantes 4. Os resumos vêm a seguir, com controles centralizados previstos para o início de 2027 13.
How this brief was made
01Gathered & sourced272 channels · 1,762 articles▾
Agents swept 272 channels and ingested 1,762 articles, then de-duplicated and ranked them for signal.
02Verified & cross-validated6 claims · 22 data feeds▾
Every one of 6 load-bearing claims was checked against primary sources, with 22 live data feeds reconciling the figures and charts.
- 1PPC Land, "Cloudflare drops planned Googlebot block for sites refusing AI training", 27 September 2026
- 2Search Engine Journal, Matt G. Southern, "Cloudflare Lets Sites Disallow AI Training Without Blocking Googlebot", 15 September 2026
- 3Best Media Info, "Cloudflare separates AI training opt-outs from search crawling for publishers", 16 September 2026
- 4heise online, Moritz Förster, "Google search yes, model training no: New Cloudflare rules", 18 September 2026
- 5Cloudflare blog, Jin-Hee Lee, "Say it once: introducing Bot Preference Sync", 21 August 2026, updated 15 September 2026
- 6Cloudflare documentation, "Block AI Bots", last updated 1 July 2026
03Reviewed & edited1 human editor▾
One editor read the draft against the evidence, tuned the framing, and signed off before it shipped.
Become a contributor
Reporting on the business of AI and want it read? We take pitches from outside contributors who bring primary sources and a number worth arguing about.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



