クラウドフレアのAI学習ブロック、止められるのはグーグル・アップル・マイクロソフト以外だけ
クラウドフレアが期限として定めた、顧客のAI学習ブロックをrobots.txt上の要望に切り替える1週間の移行期間が終わった。グーグル、アップル、マイクロソフトの3社には、その要望を尊重することが求められるだけになった。それ以外の学習用クローラーは、今もエッジで止められたままだ。
Vincent Jiang · 3 min read
クラウドフレアの2026年9月16日付の顧客向けメールは、従来の「Block AI Bots」設定が翌週からの1週間で自動移行され、完了後はダッシュボードからこの切替スイッチが消えると伝えていた 1。この1週間が終わった。パブリッシャーが「ブロック」としてクリックしたものは、最重要3社にとっては今や、テキストファイルに書き記された丁寧なお願いにすぎない。
「ブロック」は何になったか
対応関係は決まっている。従来のトグルは、検索が「Allow(許可)」、学習が「Disallow AI Training」(AI学習を許可しない)、エージェントが広告のあるページでブロックに振り分けられる 12。「Disallow AI Training」はrobots.txtに学習拒否の指示を書き込むが、Googlebot、Applebot、Bingbotの取得は続く。3社とも検索インデックス作成とモデル学習を1つのクローラーで兼用しているためだ 12。この設定が埋めようとするギャップは実在する。クラウドフレアのネットワーク上のサイトの17%は何らかの形で学習をブロックしており、検索ボットをブロックするのは1%未満。同ネットワークはウェブ全体の5分の1超の前面に立っている 13。
学習ブロックはクラウドフレアのネットワークで一般的、検索ブロックはまれ
Data
| Value | |
|---|---|
| AI学習をブロックするサイト | 17% |
| 検索クローラーをブロックするサイト | <1% |
| クラウドフレアのネットワーク背後のウェブ | >20% |
強制力は今や2層構造に
この設定が止める相手は、まだいる。OpenAI、Anthropic、メタ、アマゾンが運用する学習用クローラーは、クラウドフレアのエッジで全面的にブロックされる 4。一方、グーグル、アップル、マイクロソフトのクローラーは、クラウドフレアの「アカウンタブル(Accountable)」レーベルの下でページの取得を続ける。取得後にページがどう扱われるかは、事業者がファイルの要望を守るかどうかにかかっている 14。マイクロソフトに至っては、2027年初頭を目標とするrobots.txt対応が整うまで、新ルールを読むことすらできない 12。
「アカウンタブル」はクラウドフレア独自の呼称で、第三者機関の認証ではない 4。レーベルは、各事業者がすでに備える機能に基づいて与えられ、残る項目は期限付きのコミットメントと組み合わせた 12。さらに8月には、第4の条件として、学習を不許可にしても検索結果を損なわないことを事業者に「公に示す」よう求めていた。9月版の要求は「確約」にとどまる 51。
マニュアルは今も正反対の記述のまま
クラウドフレアの自社ドキュメント(2026年7月1日最終更新)は、兼用クローラーについて「従来の『Block AI Bots』設定を含め、AI学習をブロックするいずれの設定でもブロックされる」と今も明記している 6。同ページは各設定項目の選択肢を「Allow」(許可)、「Block on pages with ads」(広告掲載ページでブロック)、「Block」(ブロック)の3つとしている 6。一方、実際に提供されている製品には4つ目の「Disallow AI Training」(AI学習を許可しない)が存在するが、マニュアルは一切触れていない 1。実装された動作は、クラウドフレアが今も公開し続けるページの記述と正反対だ。
完全ブロックに戻る唯一の道は「Block」(ブロック)を選ぶことだが、これを選ぶとサイトはグーグル、アップル、マイクロソフトの検索から完全に締め出される 12。Bingbotをブロックすれば、サイトはBing、Yahoo、Copilotから一挙に姿を消す 1。
「領収書」が届くのは数週間後、今はまだ
不許可にしたページのうちどれがそれでも使われたのかを明らかにする仕組み、URL単位のレポーティングは、グーグルでは数週間先、アップルでは来年の提供予定だ 124。それが届くまで、帳簿の読み方は一方通行だ。パブリッシャーは検索トラフィックを守り、巨大企業はコーパス(学習データ)を守り、クラウドフレアは双方という顧客を守る。力ずくで止められ続けるのは、巨大企業のAI競合のクローラーだけだ 4。次はサマリー(要約)機能で、一元管理コントロールは2027年初頭が目標だ 13。
How this brief was made
01Gathered & sourced272 channels · 1,762 articles▾
Agents swept 272 channels and ingested 1,762 articles, then de-duplicated and ranked them for signal.
02Verified & cross-validated6 claims · 22 data feeds▾
Every one of 6 load-bearing claims was checked against primary sources, with 22 live data feeds reconciling the figures and charts.
- 1PPC Land, "Cloudflare drops planned Googlebot block for sites refusing AI training", 27 September 2026
- 2Search Engine Journal, Matt G. Southern, "Cloudflare Lets Sites Disallow AI Training Without Blocking Googlebot", 15 September 2026
- 3Best Media Info, "Cloudflare separates AI training opt-outs from search crawling for publishers", 16 September 2026
- 4heise online, Moritz Förster, "Google search yes, model training no: New Cloudflare rules", 18 September 2026
- 5Cloudflare blog, Jin-Hee Lee, "Say it once: introducing Bot Preference Sync", 21 August 2026, updated 15 September 2026
- 6Cloudflare documentation, "Block AI Bots", last updated 1 July 2026
03Reviewed & edited1 human editor▾
One editor read the draft against the evidence, tuned the framing, and signed off before it shipped.
Become a contributor
Reporting on the business of AI and want it read? We take pitches from outside contributors who bring primary sources and a number worth arguing about.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



