Cloudflare AIクローラー設定でAI学習を拒否し、検索流入を守る

Cloudflare AIクローラー設定で、検索流入を維持しながらAI学習だけを拒否する方法を解説。Search、Training、Agentの移行結果、robots.txt、Googlebot・Applebot・Bingbotへの影響、変更後に実施すべき4段階の検証手順まで、運用担当者向けに整理します。

Wednesday, September 16, 2026Omid Saffari
Cloudflare AIクローラー設定でAI学習を拒否し、検索流入を守る

Cloudflare AIクローラーの設定で検索クロールを止めず、AIモデルの学習だけを拒否するには、SearchAllowTrainingDisallow AI Training に設定し、移行後の設定と Cloudflare が配信する robots.txt の両方を確認します。Cloudflare が Block の意味を2026年9月15日に変更したため、この確認は今まで以上に重要です。現在の Block は、Googlebot、Applebot、Bingbot のような複数用途のクローラーについて、検索目的のサイトアクセスまで止める可能性があります。

Cloudflare AIクローラー設定:安全な組み合わせ

検索流入が重要なサイトなら、基本方針は明快です。Search は許可し、Training は拒否し、Agent は別の判断として設定します。

目的SearchTrainingAgent設定後の動作
検索を維持し、モデル学習を拒否するAllowDisallow AI Training個別に選択Accountable と認定された複数用途のクローラーは、検索インデックス作成を続けられます。学習専用クローラーはブロックされます。
複数用途のクローラーを完全に止めるAllowまたは、より厳しい設定Block個別に選択複数用途の Applebot、Bingbot、Googlebot を含む学習クローラーがブロックされます。検索にも影響する可能性があります。
広告掲載ページだけクローラーを制限するAllowBlock on pages with ads必要に応じて Block on pages with adsCloudflare が広告配信中と判定したページでは、複数用途のクローラーがブロックされます。

Cloudflare が9月15日に公開した説明は明確です。学習を拒否しながら検索は維持したい場合、選ぶべき設定は Disallow AI Training です。Training: Block を選ぶよう勧める古いガイドには従わないでください。変更前は複数用途のクローラーが Block の対象外でしたが、現在は対象に含まれます。

この制御機能は Cloudflare の全プランで利用できるため、上位プランを別途購入する必要はありません。費用の焦点は、別のブロック製品を買うことから、ポリシーと実際の挙動が一致しているか確かめることへ移ります。比較すると、米国での Screaming Frog SEO Spider は1シート年額$279、robots.txt 専用監視製品の一例には月額$129のプランがあります。制御そのものは Cloudflare が提供しますが、検証の仕組みは必要です。

Disallow AI Trainingは実際に何をするのか

Disallow は一部の強制措置を伴う意思表示であり、Block は扉を施錠する操作です。

複数用途のクローラーを、2枚の作業指示書を積んだ1台の配送車だと考えてみてください。一方には「検索用にこのページをインデックスする」、もう一方には「モデル学習にこのページを使う」とあります。車ごとブロックすれば、どちらの作業も止まります。Disallow AI Training なら、Accountable と認定された事業者に検索の作業は認めつつ、学習の作業だけを拒否できます。

Cloudflare は自動トラフィックの用途を3つに分けています。

  • Search は検索インデックスを構築します。
  • Training はモデルの学習またはファインチューニングを行います。
  • Agent は、チャットによる取得やブラウザ操作エージェントなど、人に代わってアクセスします。

新しい Training オプションを設定すると、Bot Preference Sync が学習拒否の指示を robots.txt に反映します。Accountable と認定された複数用途のクローラーには、引き続き検索目的のアクセスが認められます。Amazon、Anthropic、Meta、OpenAI の学習専用クローラーは、それぞれの検索クローラーを巻き込まずにブロックされます。

検索と学習をブロックしているCloudflareサイトの割合を比較した建築図面風インフォグラフィック
Search をブロックする Cloudflare サイトは1%未満ですが、Training をブロックする何らかの仕組みを使うサイトは17%です。用途を分けた制御は、この意図の違いに合っています。

Cloudflare によると、Search ボットをブロックするサイトは1%未満である一方、Training をブロックする何らかの仕組みを有効にしているサイトは17%です。この差を見れば、製品設計の狙いが分かります。単一の Block AI スイッチでは、サイト運営者が本当に望む制御には大ざっぱすぎたのです。

ここには重要な違いがあります。robots.txt の指示は、見えない防壁ではありません。それだけでは、アクセス元が誰か、何を目的にクロールしているかを判定できず、指示を無視するクローラーも止められません。Cloudflare は、公開された意思表示をネットワーク上の分類と組み合わせ、Accountable の経路に該当しないクローラーをブロックします。

Accountableでも、すべてが今すぐ使えるとは限らない

Cloudflare の Accountable ラベルは、約束された制御機能がすべて実装済みである証明ではなく、ロードマップを伴うステータスとして捉えるべきです。

認定されるには、事業者が学習のオプトアウト、AI要約のオプトアウト、URL単位の可視性、学習を拒否しても従来型検索に悪影響を与えない保証について、要件を満たすか、対応を約束する必要があります。ここでは「約束」も含まれる点が重要です。

  • Google: Google-Extended は robots.txt で拒否でき、Google はその選択が検索順位に影響しないと説明しています。また、生成検索向けのウェブマスター制御とレポートも提供しています。Google-Extended に関する追加のURL単位の透明性は、発表後の数週間で提供予定と説明されていました。
  • Apple: Applebot-Extended は robots.txt による学習オプトアウトに対応しています。Apple はAI要約向けの nosnippet とペイウォールのラベル付けにも対応しています。URL単位の確認機能は発表日時点では利用できず、翌年に向けた取り組みとされていました。
  • Microsoft: Bing の現時点での対応は異なります。サイト運営者は NOARCHIVE と、Bing の Block URLs または Content Removal ツールを組み合わせて利用できます。Microsoft は、Bingbot が robots.txt のドメイン単位の学習拒否設定に従う時期を2027年初頭としています。それまでは、Cloudflare の Disallow AI Training を設定しても、その意思表示が robots.txt を通じて Bing に自動送信されるわけではありません。

したがって、「1つのスイッチですべての用途をどこでも制御できる」というほど広い約束ではありません。新しい設定によって、検索と学習のどちらを認めるかは格段に安全に選べるようになりましたが、現時点の Bing には別途確認が必要です。

Cloudflareの移行結果を確認する

多くの設定は自動で引き継がれます。ただし、表示名と効果が大きく変わったため、移行後の状態は監査してください。

ドメインで Search、Training、Agent の詳細制御を一度も使っていなかった場合、Cloudflare は従来の Block AI Bots 設定を次のように移行します。

従来の設定新しいSearch新しいTraining新しいAgent
DisabledAllowAllowAllow
BlockAllowDisallow AI TrainingBlock on pages with ads
Block on pages with adsAllowDisallow AI TrainingBlock on pages with ads

すでに詳細制御を使っていたドメインでは、Search と Agent の実質的な状態が維持されます。Training: Allow は Allow のままです。Training: Block と Training: Block on pages with ads は、どちらも Disallow AI Training に移行します。

移行後は、次の手順で確認します。

  1. Cloudflare で対象ドメインを開き、Security SettingsConfigure AI bot policies の順に進みます。
  2. 変更する前に、現在の Search、Training、Agent の値を記録します。
  3. オーガニック検索からの流入が重要なら、SearchAllow に設定します。
  4. Accountable と認定された複数用途のクローラーを検索から排除せず、学習だけをオプトアウトしたい場合は、TrainingDisallow AI Training に設定します。
  5. Agent のポリシーは、独立した判断として選びます。Agent には確立されたインターネット上の指示がまだないため、Cloudflare は Disallow という意思表示を用意していません。
  6. カテゴリ単位のポリシーを robots.txt に反映したい場合は、Bot Preference Sync が有効であることを確認します。
  7. ポリシーを保存したら、ダッシュボードの表示だけを証拠にせず、公開されている結果を調べます。

広告で収益化する新規ドメインでは、Cloudflare の推奨プリセットがすでにこの構成になっています。Preference Sync はオン、Search は許可、Training は拒否、Agent は広告掲載ページでブロックされます。広告収益化を行わない新規ドメインは、3つの用途がすべて許可された状態で始まります。

変更後も検索クロールできるか確認する

スイッチの表示が正しいだけでは、最初の確認を通過したにすぎません。外側から内側へ、実際のポリシーを検証します。

Cloudflare設定からクローラーログまでをたどる4段階の建築図面風検証フロー
設定、配信中のrobots.txt、代表的なページへの検索アクセス、実際のクローラー動作を一連の流れとして検証します。

確認は次の4段階です。

  1. 設定: Search が Allow、Training が Disallow AI Training と表示されていることを確かめます。Agent は分けて確認します。
  2. robots.txt: 公開ドメインから実際の /robots.txt を取得します。Bot Preference Sync は生成したルールを既存ファイルの先頭に追加するため、元からある Disallow 指示も残ります。両方のセクションに競合がないか確認してください。
  3. 検索の挙動: 検索事業者のウェブマスターツールとレポートを使い、代表的なURLを確認します。「Disallow」という単語だけを見て、検索アクセスまで拒否されたと判断してはいけません。これは Accountable と認定された複数用途のクローラーが担う従来型検索ではなく、学習用の識別子または意思表示に適用されます。
  4. クローラーの動作: AI Crawl Control でリクエスト、robots.txt の遵守状況、想定外のブロックを監視します。Cloudflare は個別クローラーへの処理を適用し、動作も記録できます。意図と違うポリシー挙動を見つける実用的な確認場所です。

カスタムルールには特に注意が必要です。Bot Preference Sync が反映するのはカテゴリ全体のポリシーであり、複雑な個別ルールを読み取って生成ファイルへ変換するものではありません。特定クローラーへのライセンス例外、パス固有のロジック、カスタムWAFルールがある場合は、各レイヤーを手作業で照合してください。カテゴリ単位のポリシーでは粗すぎるときは、Sync をオフにし、自分でファイルを管理することもできます。

新しい分離設定で最も恩恵を受けるのは誰か

最大の恩恵を受けるのは、人がページを訪れることで収益を得る一方、アーカイブ全体を学習データとして取り込まれたくない事業者です。

順位対象具体的な運用収益につながる理由
1広告収益型のパブリッシャーSearch を許可し、Training を拒否し、広告掲載ページでは Agent をブロックしたうえで、クローラーの動作を監視します。検索からのページビューを維持しながら、学習と無人のエージェント訪問には厳しいポリシーを適用できます。
2公開ドキュメントを持つSEO主導のソフトウェア企業ドキュメント検索のため Search を開放し、Training は拒否して、重要なドキュメントをウェブマスターレポートで確認します。サポート資料全体を学習素材として扱わせずに、製品に関する回答を検索できる状態に保てます。
3多数のCloudflareゾーンを管理する代理店各ゾーンの3つの値をエクスポートし、Training: Block を抽出します。検索を維持すべきゾーンは Disallow に切り替え、証跡を残します。古い設定が1つ残るだけで、複数用途の検索クローラーが顧客ページにアクセスできなくなる可能性があります。ポートフォリオ全体の確認によって、検出可能な設定リスクに変えられます。
4有料リサーチまたはニュースレターのアーカイブカテゴリ全体に学習拒否の意思表示を公開し、Accountable ではない学習クローラーをブロックします。ライセンス契約のある提携先は明示的な例外として扱います。標準設定で購読者向けコンテンツを守りながら、交渉済みのアクセス経路を残せます。
5ストア用と編集コンテンツ用でドメインを分けている小売業者ストアでは広く検索されるようにし、編集コンテンツ用ゾーンでは Search を許可したまま Training を拒否します。商品の発見と独自編集コンテンツでは収益構造が異なるため、ドメイン単位でそれぞれに合うポリシーを設定できます。
6記録に基づくAI利用ポリシーを持つ規制対象企業ゾーン設定、配信中のrobots.txt、クローラーレポートを一連の証跡として保存します。文書化されていないスイッチを示すだけでなく、どの意思表示を公開し、どの強制措置を設定したか説明できます。
7公開リファレンス文書を持つ開発者向けプラットフォームSearch は許可し、Training がエコシステムの拡大に役立つかを判断し、ユーザー主導ツール向けの Agent アクセスは別に設定します。検索、学習、エージェントアクセスを1つの答えに押し込まず、3つの事業判断として扱えます。

小売業者の例からは、制御の限界も分かります。設定はドメイン単位であり、記事ごとの同意管理機能ではありません。ゾーンを分ければ別々のポリシーを適用できますが、より細かなルールを自分で追加しない限り、1つのゾーンが持てる Search、Training、Agent の方針はそれぞれ1つです。

作る価値があるプロダクト

最も有望なのは、別の robots.txt 生成ツールではなく、クローラーポリシーのリグレッション監視です。

1. クローラーポリシーのリグレッション監視

代理店や複数サイトを運営するチーム向けに、Cloudflare のポリシーを読み取り、配信中の robots.txt を取得し、代表ページへの検索アクセスを確認して、各レイヤーのずれを通知する監視ツールを作ります。

この作業に対する需要は検索数にも表れています。robots.txt generator は米国で月間約 1,000件google indexing checker は約 110件検索されています。既存ツールからは予算の存在も確認できます。robots.txt 監視製品の一例は5ドメインで月額$129、デスクトップ型SEO変更監視ツールの一例は買い切り$179です。

販売可能な最小構成に必要なのは、Cloudflare ゾーンのインポート、ポリシーと robots.txt の比較、定期チェック、変更内容を明記したメールまたは Slack 通知の4つです。クローラーの動作データとウェブマスター向けデータは、ずれの検出機能への信頼を得てから追加します。

難所は証明です。設定内容と観測したリクエストから、サイトが何を公開し、何をブロックしたかは示せます。しかし、モデル事業者がすでに収集したデータを削除したことまでは証明できません。優位性の源泉は、見た目のよいスイッチではなく、多数のドメインを横断する信頼性の高い証跡であるべきです。

2. Cloudflare移行監査ツール

移行後も危険な設定の組み合わせが残るゾーンを検出し、代理店、パブリッシャーグループ、フランチャイズ網向けに修正レポートを作る監査ツールです。

cloudflare block ai bots は米国で月間約50件検索され、CPCは$13.19です。検索への悪影響を心配する層では、google indexing checker にも月間110件の検索があります。生成ツール市場より需要は小さいものの、クリック単価の高さから、検索する人が実際の運用課題を抱えていることがうかがえます。

MVPでは、Search、Training、Agent、Bot Preference Sync のAPIフィールドを読み取り、公開中の robots.txt を取得し、各ゾーンを「検索に安全」「意図的にブロック」「設定が不整合」のいずれかに分類できます。設定と観測したファイルを並べた、顧客にそのまま提出できる証跡パックを出力します。

課題はプラットフォーム依存です。Cloudflare 自身が同じポートフォリオレポートを追加する可能性があり、需要も移行時期に集中します。監査を入口の商品にして、その後 Cloudflare や他のエッジプロバイダーを横断する継続的なリグレッション監視を販売する方が、事業としては強くなります。

この設定だけでは解決できないこと

これはポリシーの境界を明確にする仕組みであり、AIによるコンテンツ利用を完全に解決するものではありません。

  • すでに収集されたコンテンツは消去されません。Cloudflare が提供するのはクローラーへの意思表示とリクエスト制御であり、過去にさかのぼる削除ではありません。
  • すべての事業者が robots.txt に従う保証はありません。Cloudflare は Accountable の経路外にいるクローラーにネットワーク上の強制措置を加えますが、複数用途の経路では事業者が意思表示を守ることが前提です。
  • すべてのAI要約をオプトアウトできるわけではありません。要約の制御は別であり、Cloudflare は要約を横断的に制御する仕組みを今後の取り組みとして説明しています。
  • Agent に Disallow の状態を設定することはできません。
  • クローラーごとの複雑なカスタムルールを Bot Preference Sync に変換することはできません。
  • Bing 向けの学習拒否を robots.txt で自動的に表明する機能は、まだありません。Bing が現在提供している NOARCHIVE とウェブマスター向け制御は別途確認してください。
  • これは R2ファイルを改名せずにインデックスするCloudflare AI Search ではありません。別の製品、別のワークフローです。

クローラーを本当に締め出したいときは Block を選びます。検索による発見が事業モデルの一部なら、Disallow AI Training を選びます。9月の変更で最も重要なのは、この違いです。

次の月曜日にやること

来週、代表的なドメインを3つ選びます。広告収益型を1つ、検索流入型を1つ、カスタムクローラールールを持つものを1つです。移行後の Search、Training、Agent の値を記録し、事業目的が明確なサイトだけを変更します。そのうえで、実際の robots.txt とクローラーレポートを変更チケットと一緒に保存してください。この3つで問題がなければ、同じ証跡ベースの確認をポートフォリオ全体に展開します。

AI学習を無効にするには?

Cloudflare で管理するドメインでは、Accountable と認定された複数用途のクローラーに検索アクセスを残しながら学習拒否の意思を公開したい場合、Training を Disallow AI Training に設定します。複数用途のクローラーによる検索への影響も受け入れられる場合に限り、Block を使います。

AIコンテンツをすべてブロックする方法はある?

クローラーのカテゴリ単位または個別クローラーのブロックは可能ですが、「すべてのAIコンテンツ」には複数の異なる用途が混在しています。Cloudflare は自動アクセスを Search、Training、Agent に分け、許可する用途を選べるようにしています。Training をブロックしても、検索製品からAI生成コンテンツが消えるわけではなく、収集済みデータも削除されません。

検索のAIモードを無効にするには?

Cloudflare のクローラー設定は、利用者側のAI検索体験をオフにするものではありません。制御するのは、自分のドメインへのアクセスです。Google などの事業者は生成要約向けに別の制御を提供しており、従来型のインデックス作成と学習への意思表示も、それぞれ独立した判断です。

事業向けに、このようなクローラーポリシーの監査・監視基盤を構築したい方は、AIプロダクションシステムをご覧ください。

最終更新
2026年9月16日
カテゴリー
Build

Googleでこのサイトを優先する

omidsaffari.comをGoogle検索の優先ソースに追加

omidsaffari.comを優先ソースに設定すると、GoogleがTop Stories・AI Overviews・AI Modeであなたのために優先表示します。

音声入力アプリMurmureを検証:オフライン運用の実力

音声入力アプリMurmureを検証:オフライン運用の実力

無料で使えるオフライン音声入力アプリMurmure 1.11.3を、技術用語を含む19.817秒の音声で検証。辞書と整形ルールの精度、ローカル/リモートLLMの違い、Windows・macOS・Linuxの注意点、料金、向いている人、見送る条件までを実測結果から詳しく解説します。2026年9月14日Build
FFmpeg APIの料金を解剖:RenderIOはいつ割安になる?

FFmpeg APIの料金を解剖:RenderIOはいつ割安になる?

RenderIOのFFmpeg API料金を、月額プラン、コマンドクレジット、超過料金、チェーン実行、動画ダウンロードまで検証。Starter・Growth・Businessの損益分岐点と、実行時間・ストレージ・Webhookで上位プランが必要になる条件を、具体的な数字で解説します。2026年9月14日Build
AI 音声入力は本当に無料?Dictareの料金と実質コスト

AI 音声入力は本当に無料?Dictareの料金と実質コスト

AI 音声入力ツールDictareは、ソフトウェア料金が$0で、有料プランや公開された利用上限もありません。ローカル処理に必要なマシン、導入・運用時間、別契約となるコーディングエージェントの費用を切り分け、SpokenlyとWispr Flowの料金も比較。無料運用の条件と選び方を明快に解説します。2026年9月13日Build
Claude Code プラグインのeval入門:効果を差分で検証する

Claude Code プラグインのeval入門:効果を差分で検証する

Claude Code 2.1.269で追加されたネイティブplugin evalを使い、プラグインあり・なしの実行を比較する方法を解説します。ケースとgraderの設計、WITH・W/OUT・Δの読み方、意図的な回帰テスト、コスト管理、CIゲートへの組み込みまで、再現可能なリリース判定を具体例とともに整理します。2026年9月12日Build
音声AIエージェントの遅延原因をCloudflareで切り分ける

音声AIエージェントの遅延原因をCloudflareで切り分ける

Cloudflareのturnmetricsを使い、音声AIエージェントの遅延や無音応答をステージ別に切り分ける方法を解説します。7つのoutcome、各タイミングの読み方、3つの制御テストを押さえれば、モデルやTTSを推測で変更する前に、文字起こし・モデル・音声生成・ブラウザ再生のどこを調べるべきか判断できます。2026年9月12日Build
動画に字幕を入れる:RendiでSRTを焼き付ける実践ガイド

動画に字幕を入れる:RendiでSRTを焼き付ける実践ガイド

動画に字幕を入れる方法を、Rendiの非同期FFmpeg APIを使った実装例で解説します。SRTの事前確認、字幕スタイルの指定、ジョブ送信と完了確認、出力MP4の品質チェック、料金を左右する容量計算まで、バッチ処理へ進む前に押さえる実務手順と注意点を具体的にわかりやすくまとめました。2026年9月11日Build
OpenAI Agents SDKかAgents APIか:開発体制で決める選び方

OpenAI Agents SDKかAgents APIか:開発体制で決める選び方

OpenAI Agents SDKとAgents APIのどちらを選ぶべきか。セッション管理、実行環境、データ保持、料金、移行コストを比較し、小規模チームから規制業界まで、開発体制に合う判断基準を具体例と試算で整理します。長時間タスク、ZDR、セルフホスト、運用負荷の違いも分かります。2026年9月11日Build
FFmpeg APIで見るRendi料金:動画時間より処理バイト数で選ぶ

FFmpeg APIで見るRendi料金:動画時間より処理バイト数で選ぶ

RendiのFFmpeg API料金を、入出力の処理量、ストレージ、コマンド実行時間、vCPUの4条件で比較。Freeから月額$25のPro、実行時間無制限プランまで、動画処理パイプラインに必要な最小構成の選び方、隠れコスト、Very Good FFmpeg・RenderIOとの違いを具体例で解説します。2026年9月11日Build
ニュースレター

毎週日曜、一通の手紙。動くシステムの話。感想戦ではなく。

週刊。スパムなし。いつでも解除できます。