Webトラフィックの6割がボット!AIボット3タイプの違いとCloudflareでの最適なアクセス制御方法

目次

1. Webトラフィックの6割が「ボット」の時代

現代のWebサイトで発生するアクセス(トラフィック)の60%以上はボット(自動プログラム)が占めるというデータがあります。

特に近年の生成AIの急拡大に伴い、膨大な量の「AIボット」がインターネット上を回遊するようになりました。

これまでは「悪意ある攻撃やスパムを防ぐ」ことがボット対策の主流でしたが、現在は「自社のWebコンテンツがどのようにAIに使われるか」を主導権を持って管理するフェーズへ移行しています。

2. 一言でAIと言っても種類は様々。AIボットの「3つの目的」

すべてのAIボットを一括でブロックしてしまうと、Webサイトの集客や便利な自動化機能まで損なってしまう可能性があります。

Cloudflareでは、AIボットをその目的と挙動に応じて以下の3タイプに整理・制御できます。

タイプ主な役割と仕組み(定義)遮断した場合の影響・リスク
① AI トレーニングコンテンツをクロールし、モデルのトレーニングや微調整(ファインチューニング)のためにデータを永続的に取り込む自社データや著作物が無断でモデルに永続学習されるのを防げる(基本は止めても問題なし)。
② AI 検索後で質問に答えることができるよう、コンテンツを収集・インデックス化するAI検索の回答根拠として自社サイトが引用・紹介されなくなり、新しい検索チャネルからの流入機会を失う。
③ AI エージェントエージェントチャットボットやブラウザ利用エージェントが、人に代わってリアルタイムで作業・処理を行うAIツール経由のユーザーアクセスや、エージェントによる自動化機能の利用が制限される可能性がある。

3. 「AI トレーニング」が引き起こすサーバー負荷問題

AIの学習用ボットは、モデル生成のためにサイト全体の構造や文章を網羅的かつ大量に取得します。

この高頻度なクロールによってサーバーに負荷がかかると、以下のようなリスクが生じます。

  • 一般のユーザーが訪問した際の表示速度が低下する
  • インフラの転送量が増大し、無駄なサーバーコストが発生する

学習用ボットを無条件に巡回させることは、自社のインフラリソースを無償で外部のAI企業に提供している状態になりかねません。

4. Googlebotが持つ「特殊な構造」

AIボット対策を進めるうえで、注意すべきなのが「Googlebot」の存在です。

通常のボットと異なり、Googlebotは「Google検索のインデックス作成」と「生成AI(Gemini等)のためのデータ収集」を兼ね備えた複合目的(Mixed-purpose)のクローラーという特殊な性質を持っています。

そのため、学習を防ぎたいからといって仕組みを理解せずに一律遮断してしまうと、Google検索のインデックスから自社サイトが消えてしまう危険性があります。

5. Cloudflareなら目的別に「クリック操作」で選んで処理できる

従来のセキュリティ設定では難しかったボットの制御ですが、Cloudflareの管理画面を使えば目的別にクリック操作だけで柔軟にアクセスポリシーを変更できます。

Cloudflareの推奨設定(基本方針)

自社のWeb資産(コンテンツとインフラ)を守りつつ、集客(SEO)を維持するためのベストプラクティスです。

  • AI トレーニング → 「許可(ブロックしない)」(※詳細は後述)
  • AI 検索 → 「許可(ブロックしない)」
  • AI エージェント → 「許可(ブロックしない)」
Cloudflareの推奨設定

6.「AI トレーニング」を止めたい場合:「Disallow」と「ブロック」の違い

AI トレーニングをブロックする際、Cloudflareの設定選択肢にある「Disallow」と「ブロック」の違いを正しく理解しておくことがSEOの維持において不可欠です。

① Disallow 【SEO安全・推奨】

  • 挙動: GPTBotやClaudeBotといった「AI学習専用クローラー」を遮断しつつ、Googlebotのような「複合目的クローラー」は除外してアクセスを許可します。
  • SEOへの影響: Googleの検索用クローラーの巡回を維持したまま、純粋なAI学習スクレイパーによるデータ収集だけを停止できます。

② ブロック 【SEO高リスク】

  • 挙動: 複合目的クローラー(Googlebot / Google-Extended)を含め、すべてのAI学習クローラーをすべてのページから厳格に遮断します。
  • SEOへの影響: 「ブロック」を選択するとGooglebotの学習活動だけでなく通常のクロール活動まで弾いてしまい、検索エンジンの表示順位やインデックスに悪影響を及ぼす恐れがあります。

まとめ

自社サイトの検索流入(SEO)を守りながらAIの無断学習を防ぐには、一律の「ブロック」ではなく、Googlebotに配慮した「Disallow」を活用した個別コントロールが最も安全で効果的な手法となります。

株式会社ドーモでは、Cloudflareの認定パートナーとして、AI活用に向けたインフラ設計・導入支援から既存システムのWorkers移行・コスト最適化までトータルでご支援しています。自社APIのAI化やコスト改善をご検討の際は、ぜひご相談ください。

Web表示スピード改善・セキュリティ対策のCloudflare

導入のご相談だけでなく、運用フェーズでのサポートも承ります。
DDoS攻撃や悪質なBot(ボット)からのアクセスを防ぎたい方、WAF機能やプランの詳細を知りたい方、
国内エンジニアによる安心の運用サポートをご希望の方も、ぜひお気軽にお問い合わせください。

目次