AIクローラーは3種類+土台。GEO対策の正解は「特定Bot最適化」ではなく「全Bot対応」にある
AIクローラーは3種類+土台で構成される|GEO対策は「全Bot対応」にある
AIがWebサイトの情報を取得するBotは、目的とタイミングによって①インデックス型・②学習型・③代理アクセス型の3種類に分類できます。それらの土台として、従来の検索エンジン型Botが存在します。
GEO対策とは「特定のBotへの最適化」ではなく、「どのBotが来ても引用・理解・学習されやすい状態を作ること」だと整理できます。つまり、GEOの正解は「全Bot対応」にあります。
この記事は、Genviewを開発する中で私自身が整理した「理解の地図」をそのまま公開するものです。現時点では各社の公式ドキュメントと海外の検証データを参照した整理であり、Genview上での自社検証(Botの来訪頻度・引用率の変化など)は今後順次追記していきます。
この記事でわかること
- AIクローラーBotの「3+1」分類とそれぞれの動き方
- インデックス型・学習型・代理アクセス型ごとの対策の方向性
- 各Botの来訪頻度と海外調査データ
- どのBotにも共通して効くGEO対策の基本設計
なぜBot分類が必要なのか
GEO対策の「なぜ」を理解するには、AIがどうやってWebから情報を取っているかを知る必要があります。
GEO対策を調べていると「FAQ構造が大事」「定義文を入れろ」「スキーマを実装しろ」という情報が飛び交っています。どれも正しいのですが、なぜその対策が効くのかの説明がないことが多い。その「なぜ」を理解するには、AIがどうやってWebから情報を取っているかを知る必要があります。そこで登場するのがAIクローラーBotです。
2026年時点で主要なAIクローラーは10種類以上存在し、それぞれ動き方・目的・評価軸がまったく異なります。これを整理せずに対策しても、効果の根拠が曖昧なままです。
「3+1」分類の概要
AIクローラーBotは、大きく以下の4カテゴリに整理できます。各分類は「動きのタイミング」と「目的」によって明確に区別されます。
| 分類 | 代表的なBot | 動きのタイミング |
|---|---|---|
| ① インデックス型 | OAI-SearchBot / PerplexityBot / Claude-SearchBot | 常時巡回→質問時に参照 |
| ② 学習型 | GPTBot / Google-Extended / ClaudeBot | 長期的に収集→AIの知識へ |
| ③ 代理アクセス型 | ChatGPT-User / Claude-User | 質問の瞬間にオンデマンド取得 |
| 【別レイヤー】従来型 | Googlebot / Bingbot | 従来の検索エンジン(全対策の土台) |
それぞれの分類で動き方・評価軸・対策の方向性が異なります。以下で各分類を詳しく解説します。
① インデックス型:事前収集して質問時に参照する
OAI-SearchBot(OpenAI)・PerplexityBot・Claude-SearchBot(Anthropic)が該当します。ユーザーが検索する前から常時Webを巡回して独自のデータベースを構築し、ユーザーの質問時にそこから高速で情報を取り出して回答を生成します。
OAI-SearchBot
OAI-SearchBotはChatGPT Search向けの独自インデックス構築に利用されるBot。OpenAIの公式ドキュメントに明示されている通り、学習用のGPTBotとは独立した別のBotです。なお、ChatGPT SearchはOAI-SearchBotによる独自収集のほか、Bingのインデックスやリアルタイム取得も組み合わせたハイブリッド型の情報取得を行っています。
PerplexityBot(2026年5月時点)
PerplexityBotはPerplexity AIが運営する検索・回答エンジンの情報源。2026年5月時点の公式説明では、基盤モデル学習ではなく検索インデックス用途とされています(AI企業は仕様を変更することがあるため、最新の公式情報もあわせてご確認ください)。
Claude-SearchBot(2026年5月時点)
2026年5月時点のAnthropic公式ドキュメントでは、Claude-SearchBotは「検索インデックス用のBot」として明確に分類されており、代理アクセス型のClaude-Userとは役割が異なります。
インデックス型への対策の方向性
これらのBotは「引用しやすい構造」を最重視します。具体的には以下の4点です。
- 見出し(H2/H3)の直下に結論を置くBLUF(Bottom Line Up Front)構造
- FAQ形式による質問と回答のセット
- 数字・出典が明確な一次情報
- ドメインの信頼性(被引用実績・権威性)
「HTMLテキストの構造の綺麗さだけが対策」ではなく、ドメインそのものの信頼性も大きく影響します。きれいなHTMLが書けていても、信頼性の低いドメインからは引用されにくい傾向があります。
② 学習型:長期的にAIの知識になる
GPTBot(OpenAI)・ClaudeBot(Anthropic)・Google-Extended(Google)が該当します。数ヶ月〜数年単位でWebのデータを収集し、AIモデルの基礎知識(パラメータ)として学習させるためのBotです。
厳密には、GPTBotとClaudeBotは独立したクローラーですが、Google-Extendedはクローラーそのものではなく「Googleのクローラーに対してAI学習利用を許可するかどうかを制御するUser-agentトークン」という性質を持ちます。この記事では便宜上「学習利用系」としてまとめていますが、技術的な位置づけが異なる点には留意してください。
公式ドキュメントからの根拠
- OpenAI公式:GPTBotについて「OpenAIの生成AIの基盤モデルをより有用かつ安全にするために使用する」と明記
- Google公式:Google-Extendedについて「GeminiモデルおよびVertex AIのトレーニングと、AI回答のグラウンディングに使用する」と説明
Grok系Bot(2026年5月時点)
Grok系Bot(xAI)については、2026年5月時点で公式ドキュメントが一切公開されていません。X(旧Twitter)上でのリアルタイムの言及やトレンドが影響すると推測されていますが、詳細は不明であり、この記事の情報もすべて推測ベースです。
学習型への対策の方向性
- サイト全体の専門性(ハブ&スポーク構造)
- 概念(エンティティ)の網羅的な定義
- 著者・組織のE-E-A-T(経験・専門性・権威性・信頼性)
- 論理の一貫性・用語の統一
学習型Botへの対策は「今すぐ引用される」ことよりも、「AIの知識の中にどう刻まれるか」という長期的な視点が必要です。
③ 代理アクセス型:質問の瞬間にページを取りに来る
ChatGPT-User(OpenAI)とClaude-User(Anthropic)が該当します。事前のデータベースを持たず、ユーザーがプロンプトで「このURLを読み込んで」と指示したその瞬間に、ユーザーの身代わりとしてピンポイントで対象ページへ直接アクセスします。
Anthropicは2026年2月に公式ドキュメントを更新し、ClaudeBot(学習用)・Claude-SearchBot(検索インデックス用)・Claude-Userの3Bot体制と各Botの役割を明示しました。このうち代理アクセス型に該当するのはClaude-Userであり、「Claudeのユーザーが質問した際に、ウェブサイトへのアクセスを支援するBot」と定義されています。Claude-SearchBotは①インデックス型に分類される別のBotです。
代理アクセス型への対策の方向性
- H2/H3見出しごとに「その見出しの答え」が直下にある構造
- 長文でも崩れないセマンティックHTML(正しい見出し階層)
- JavaScriptに依存しない本文テキストの記述
【別レイヤー】従来型検索エンジン:すべての土台
GooglebotとBingbotは、AI検索用ではなく従来の検索エンジンのためのBotです。しかし、OAI-SearchBotはBingの検索APIを裏側で利用するハイブリッド型であることが知られており、PerplexityなどもGoogleやBingのインデックスを補助的に利用していると見られています(公式による全面的な明示はなし)。
つまり、従来のSEO(Googlebot対策)ができていないサイトは、そもそもAI検索の選択肢にすら上がらないという構造があります。これがGooglebotを「別レイヤー」として独立させた理由です。
Botの来訪頻度:海外データで見えてきたこと
各Botがどのくらいの頻度でサイトを訪れるのか。現時点では海外の観測データを参照します。
Cloudflare AIクローラートラフィック調査(2025年10〜11月)
Cloudflareが2025年10〜11月のHTMLリクエストを分析したデータです。ユニークページの到達率を比較すると、Googlebotが他のAIクローラーと比べて圧倒的なカバレッジを持っていることがわかります。
| Bot | ユニークページ到達率 |
|---|---|
| Googlebot | 11.6% |
| GPTBot | 3.6% |
| ClaudeBot | 2.4% |
| PerplexityBot | 0.06% |
Googlebotのカバレッジは他のAIクローラーと比較して圧倒的であり、これが「Googlebot=全AI対策の土台」という整理の根拠のひとつです。ソース:Cloudflare AIクローラートラフィック調査(Search Engine Journal転載) / 元のCloudflareブログ
12サイト・30日間のサーバーログ調査(2026年3〜4月)
海外の実態調査(12サイト・30日間のサーバーログ分析)による1サイトあたりの1日の平均ヒット数です。GPTBotが最も頻繁にアクセスしており、次いでClaudeBotとなっています。
| Bot | 1日あたり平均ヒット数 |
|---|---|
| GPTBot | 4,200件 |
| ClaudeBot | 1,800件 |
| PerplexityBot | 980件 |
| Google-Extended | 540件 |
また、GPTBotは高トラフィックページを平均2.4日ごとに再訪問するのに対し、ClaudeBotは平均6.8日ごとと、頻度に大きな差があります。頻繁に更新するサイトほどGPTBotに先に拾われる傾向があることが示されています。
AI検索流入の急成長
AI検索経由の訪問数は、2025年Q1から2026年Q1の1年間で156億件から274億件へ42.8%増加したというデータも出ています。AI検索はすでに「将来の話」ではなく現在進行形のチャネルです。
※上記データはいずれも海外サイトを対象とした調査です。日本語サイトにおける実態については、Genviewでの自社検証を進めており、データがまとまり次第この記事に追記します。
3分類に共通して効く対策
各Botの動き方は異なりますが、どのBotにも共通して効果がある対策が存在します。これがGEO対策の基本設計です。以下の表では、共通対策とその理由を整理しています。
| 対策 | なぜ全Botに効くか |
|---|---|
| FAQ・定義文の設置 | インデックス型も代理アクセス型も「答えやすい構造」を好む |
| 見出し(H2/H3)+結論配置 | どのBotもセクション単位で情報を取得する |
| 一次情報・出典の明示 | 学習型も引用型も信頼性を評価軸に持つ |
| セマンティックHTML | JS除去後も意味が伝わる構造はすべてのBotに有効 |
| E-E-A-T・著者情報 | 学習型は特に重視。インデックス型も信頼性判断に使う |
GEO対策は「どのBotに何をするか」を個別最適化するのではなく、「どのBotが来ても対応できる状態を作る」ことが本質です。Bot分類の知識は「なぜその対策が必要か」を理解するための地図として使うのが正しい使い方だと考えています。
今後Genviewで検証すること
この記事に書いた内容は、現時点では公式ドキュメントと海外の観測データをもとにした整理です。Genviewの開発・運用を通じて、以下の検証を自社で進めていきます。
- 各AIクローラーBotの来訪頻度(日本語サイト・規模別)
- Botの来訪からAI引用までのタイムラグ
- FAQ形式の文章構造の有無による引用率の変化(FAQPage構造化データを含む場合あり)
- セマンティックHTML実装前後でのBot挙動の差
- ClaudeBot・GPTBot・PerplexityBotで引用されるコンテンツの構造的な違い
検証データがまとまり次第、この記事に追記または別記事として公開します。「GEO対策ツールを作っている人間が、一番深くGEOを理解している」という姿勢で発信を続けます。
よくある質問
- Q: GEO対策はSEO対策と別でやる必要がありますか?
- A: 別ではなく、SEOが土台になります。Googlebotにインデックスされていないページは、AI検索の対象にもなりにくい構造があります。まずSEOの基盤を整えた上で、GEO対策を重ねるのが正しい順序です。
- Q: robots.txtでBotをブロックすべきですか?
- A: 学習用Bot(GPTBot・ClaudeBot)のブロックは、AI回答での引用・検索への掲載には影響しません。ただし、インデックス型Bot(OAI-SearchBot・PerplexityBot)をブロックすると、ChatGPT SearchやPerplexityの検索結果から除外されます。目的に応じて個別に設定することを推奨します。
- Q: PerplexityBotはGoogleやBingと何が違いますか?
- A: GooglebotやBingbotは従来の検索エンジンのためのBotで、ユーザーに検索結果リンクを返します。PerplexityBotはAI回答生成のための情報収集を行い、回答内に引用URLとして表示される点が異なります。引用元として明示されるため、クリック流入に直結しやすい特性があります。
参照・出典
- OpenAI公式:Crawlers概要
- Anthropic:クローラー公式ドキュメント(2026年2月更新)
- Search Engine Journal:Google-Extended 公式説明(2025年4月)
- Perplexity公式:Crawlers
- Search Engine Journal転載:Cloudflare AIクローラートラフィック調査(2025年10〜11月)
- Cloudflare公式ブログ:AI bot traffic
- Digital Applied:12サイト・30日間サーバーログ調査(2026年4〜5月)
- Contently:AI検索流入成長データ(2026年5月)
- No Hacks:AIクローラー全景2026