AIToday

Cloudflareがサイト所有者にAIボット選別を許可

Hacker News16時間前LINEで送る
Cloudflareがサイト所有者にAIボット選別を許可

要点

Cloudflareは、ウェブサイト所有者にAIボットがコンテンツにアクセスできるかについて、より細かく制御できる権限を与えている。従来のすべて許可かすべてブロックかの選択肢を廃止し、Search(デフォルトで許可)、Agent、Training(2026年9月15日から広告表示ページではデフォルトでブロック)の3つのカテゴリを導入した。この変更は、サイトが検索可視性とAIモデル訓練からの保護の間で不公正に選択を迫られているとの1年間のフィードバックに対応し、所有者がボットがどのようにコンテンツを保存・再利用できるかを指定できる「コンテンツ利用」フレームワーク(即座、参照、完全)を導入している。

こういう要約が、毎朝あなたのメールに届きます。

無料で登録 →

3つのポイント

  • 何が起きたか

    Cloudflareは、ウェブサイト所有者がAIトラフィックを3つのユースケース(検索結果のインデックス化のためのSearch、ChatGPT取得のようなリアルタイムタスクのためのAgent、モデル微調整のためのTraining)で管理できる新しいコントロールを開始した。従来の「AIボットをブロック」オプションが廃止される。2026年9月15日から、新規ドメインは広告を表示するページ上ではTrainingとAgentボットをデフォルトでブロックし、Searchを許可する。同社はまた、既知のすべてのボットとその分類およびコンテンツ利用行動を検索可能なデータベースを提供するエンタープライズ機能「BotBase」を導入した。

  • なぜ重要か

    サイト所有者は長年、検索可視性とAI学習からのコンテンツ保護の間で選択を迫られてきた。これは大規模既存企業に利益をもたらす不公正なトレードオフである。Cloudflareの分類体系により、小規模サイトは有益な検索トラフィックを許可しながら、報酬なしにモデルを訓練またはコンテンツをスクレイピングするボットをブロックまたは制限できる。「コンテンツ利用」レベル(即座、参照、完全)は、所有者にコンテンツがどのように再利用されるかを細かく制御させ、元の「すべてのAIをブロック」アプローチが粗すぎたという1年間のフィードバックに対応している。

  • 注目点

    2026年9月15日のデフォルト変更は、Google、Apple、Bingのボットのような多目的クローラーに影響を与える。所有者が制限を選択した場合、Cloudflareが最も制限的なルールを適用するため、クローラーが複数の目的を果たすときはTrainingでブロックされる。サイト所有者はその日付前にいつでもセキュリティ設定を通じて新しいデフォルトをオプトアウトできる。2026年後半、BotBaseは可視化から直接制御に拡張され、エンタープライズ顧客が特定のボットをリアルタイムで強制できるようになる。

詳細

Cloudflareは「Content Independence Day」イニシアティブを開始してから1年後、ウェブサイト所有者がサイトへのAIトラフィックをどのように管理すべきかを再考している。同社の元の「AIボットをブロック」機能は単一目的のソリューションを提供した:モデルデータで訓練されたクローラーを停止する。しかし顧客との会話と市場の観察により、そのアプローチは不十分であることが明らかになった。ウェブサイト所有者は、すべてをブロックするのではなく、異なる種類のAI自動化(有益なものと搾取的なもの)を区別できることを望んでいた。Cloudflareの新しいフレームワークは3つのユースケースを定義している。Searchは後で質問に答えるためのコンテンツのインデックス化または収集をするクローリングを包含し、サイト所有者が紹介トラフィックまたは補償を受け取るべきという仮定がある。Agentはある人に代わって行動するリアルタイム自動化された動作をカバーし、ChatGPT User-Agent取得またはGeminiやClaudeのようなブラウザ使用エージェントがChromeを駆動するもののような場合がある。これらのボットは、タスクをすぐに完了するためにウェブアプリケーションを訪問する。Trainingはモデルの基礎アーキテクチャにコンテンツを吸収するクローラーを指す。これら3つのカテゴリのそれぞれを、フリーティアを含むすべての顧客が利用可能なCloudflareで個別に管理できる。これら3つ以外に、Cloudflareの分類法は他のボット動作(広告検証、フィード取得、SEOクローリング、セキュリティテスト、データ収集、および監視)も追跡し、自動化されたウェブトラフィックの進化した状態を反映した完全な説明である。同社はボット運営者に目的別にクローラーを分離することを呼びかけており、透明性はボットが訪問する理由を明確にしてサイト所有者がより細かいアクセス制御を有効にすることで利益をもたらすと主張している。2026年9月15日から、Cloudflareはプラットフォームにオンボーディングするすべての新規ドメインに新しいデフォルトを適用する。広告を表示するページ上で、TrainingとAgentボットはデフォルトでブロックされ、Searchは許可されたままになる。理由は簡潔である:広告はウェブサイト所有者が人間の注目がそこに到達して収益化することを意図したことを示す。その注意を妨げるボットはサイト所有者のビジネスモデルを害し、一方、検索トラフィックは通常、サイトに訪問者を流す。Search with Trainingを組み合わせた多目的クローラー(Google、Apple、Bingのボットを含む)は、顧客が適用した最も制限的なルールに従う。サイト所有者がTrainingをブロックすることを選択した場合、これらの多目的クローラーは完全にブロックされる。Cloudflareは顧客に今後の変更を通知し、2026年9月15日前のいつでも設定を変更してオプトアウトできるようにする。エンタープライズ顧客については、Cloudflareはまた新しいダッシュボード機能「BotBase」を開始し、既知のすべてのボット、分類法全体での分類、およびコンテンツ利用行動の検索可能なデータベースを提供する。この可視化ツールは後に直接制御に拡張され、エンタープライズ顧客がリアルタイムで既知のボットを管理できるようにする。Cloudflareはまたrobots.txtの新しいオプションフィールド(Content Signals標準の一部)を導入し、「use」と呼ばれ、サイト所有者が3つのコンテンツ再利用設定の1つを表現できる:即座(対話するが保存しない)、参照(インデックス化、抜粋、および逆リンク)、完全(要約と再現)。既にCloudflareの管理robots.txtを使用しているすべての顧客は、既存のsearch=yes,ai-train=noシグナルと一緒に自動的にuse=referenceを追加される。これらのシグナルを乱用するボットは検証済みステータスを失い、プラットフォーム上で許可されなくなり、サイト所有者の設定を尊重し、新興標準への準拠を維持するために運営者にインセンティブを作成する。

背景と解説

Cloudflareの更新は、ウェブコミュニティがAIボットトラフィックをどのように見るかについての根本的な転換を反映している。1年前、同社は創作者に報酬を払わずにコンテンツをスクレイピングするAIシステムに対する実存的な脅威と呼ぶものに対応して、厳格なバイナリの選択肢「AIボットをブロック」を開始した。しかし1年間の顧客フィードバックはこのアプローチの欠陥を明らかにした:それは小規模ウェブサイトに最も害をもたらし、検索エンジンを通じた発見可能性とAI訓練からの保護の間で選択を迫った。これは検索とAIインフラストラクチャの両方を制御する大規模既存企業を定着させるファウスト的な取引である。新しい3カテゴリ分類法(Search、Agent、Training)と「コンテンツ利用」フレームワークは、すべてのAI自動化が略奪的なわけではないことを認識している。リアルタイムエージェント動作と検索インデックスはサイト所有者に価値をもたらす可能性があり、同時に所有者にコンテンツが報酬なしに専有モデルに完全に吸収されるのを防ぐツールを与えている。Searchを許可デフォルトとして設定し、広告サポートページ上でTraining/Agentをブロックデフォルトとして設定することにより、Cloudflareはほとんどのサイト所有者が訓練ボットからのリスクよりも検索可視性から利益を得ると賭けている。2026年9月15日の日付は、Google、Apple、Bingのボットのような大規模多目的クローラーに影響を与えるため注目に値する。これらは検索と訓練の両方のためにクローリングするボットであり、これらの運営者にクローラーを分離するか(Cloudflareが推奨するように)、制限的なデフォルトを選択したサイト上のブロッキングを受け入れることを強制する。

よくある質問

新しいデフォルトはいつから有効になりますか
2026年9月15日に、Cloudflareはすべての新規ドメインに新しいデフォルトを設定する。広告を表示するページ上ではTrainingとAgentボットがデフォルトでブロックされ、Searchは許可されたままになる。既存の顧客は、その日付前にいつでもセキュリティ設定を通じてこれらの変更をオプトアウトできる。
Cloudflareが区別している3つのAIユースケースは何ですか
Search(検索結果のためのコンテンツをインデックス化するためのクローリング)、Agent(ChatGPTやClaudeブラウザフェッチのようなユーザーに代わって自動化されたリアルタイムアクション)、Training(モデルを訓練または微調整するためのクローリング)。ウェブサイト所有者は各カテゴリを個別に管理できる。
「コンテンツ利用」設定は何をしますか
サイト所有者がボットがコンテンツを再利用する3つのレベルを指定できる:即座(対話するが保存しない)、参照(インデックス化、抜粋、および逆リンク)、完全(要約と再現)。所有者はこれらをボット分類と組み合わせて、「Searchボットのみ参照レベルまで許可する」というようなルールを表現できる。

こうしたAIニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

ディスカッション

この記事のディスカッションはまだありません

AIニュースを毎日お届け

200以上のソースから厳選したAIニュースを毎日無料でお届けします。

無料で始める

登録無料・30秒で完了・いつでも解除できます