一般的な検索エンジンにインデックスされているページでも、自動的にChatGPT Searchの引用元として表示されるわけではありません。OpenAIは検索機能向けの専用クローラーOAI-SearchBotを運用し、検索表示とモデル学習に関する制御を分けて案内しています。
以下の6つの手順では、公開者が実際に管理できるクロール許可、インデックス信号、ボットの分離、インフラ側の遮断、流入計測を確認します。
1. ページが公開され、クロール可能か確認する
ログインなしでページを開けるか確認し、見つけてもらいたいパスが意図せず遮断されていないか確認します。公開サイトでもOAI-SearchBotがアクセスできなければ、ChatGPT Searchで利用される可能性が制限されます。
2. robots.txtでOAI-SearchBotを確認する
OpenAIはOAI-SearchBotをChatGPT Searchでウェブサイトを見つけるためのクローラーとして説明しています。検索表示を許可したい場合は、必要なパスでこのUser-agentをブロックしないようにします。
User-agent: OAI-SearchBot
Allow: /
robots.txtの変更が検索システムに反映されるまで、およそ24時間かかる場合があります。変更直後に結果が変わるとは限りません。
3. 検索表示とモデル学習の制御を分ける
OAI-SearchBotとGPTBotは役割が異なり、OpenAIはそれぞれ別の制御として説明しています。検索のためにOAI-SearchBotを許可しつつ、GPTBotを別途制限することもできます。一方を変更すれば他方も自動的に変わると考えないようにします。
4. noindexとページ単位の信号を確認する
ページを表示させたくない場合、noindexメタタグを利用できます。ただし、その指示を読むにはクローラーがまずページへアクセスできる必要があります。
そのため、robots.txtによる全面的な遮断とページ単位のnoindexは同じ制御ではありません。目的に応じて使い分けます。
5. CDN・ファイアウォール・ボット防御を確認する
robots.txtが正しくても、CDN、WAF、ファイアウォール、自動ボット防御がクローラーに403などを返すとアクセスできません。必要に応じてOpenAIが公開しているクローラーUser-agentやIP範囲を基準にインフラ設定を確認します。
6. 推測せずChatGPTからの流入を測定する
OpenAIは、ChatGPTからの参照URLにutm_source=chatgpt.comが含まれる場合があると案内しています。Google Analyticsなどで追跡すれば、実際のChatGPT経由の訪問を確認できます。
ただし参照流入は訪問の証拠であり、引用品質、順位、AI全体での露出を示すものではありません。技術的にクロール可能でも流入が少ない、またはゼロの場合があります。
簡単なChatGPT Search表示チェックリスト
- 公開: 認証なしで対象ページを開けるか?
- Robots: 必要なパスでOAI-SearchBotを許可しているか?
- 制御: OAI-SearchBotとGPTBotを意図どおり別々に設定しているか?
- インデックス: noindex設定が希望する表示方針と一致しているか?
- インフラ: CDN、WAF、ボット防御がクローラーを遮断していないか?
- 計測:
utm_source=chatgpt.comの流入を追跡しているか?
原則: AI検索での表示は、特定ページが必ず引用されるという約束ではなく、まずクロール可能性と実際の流入を確認する問題として扱います。
主な情報源
- OpenAI Developers — Overview of OpenAI Crawlers
- OpenAI Help Center — Publishers and Developers FAQ
- OpenAI Help Center — Guidance for allowing OpenAI web crawlers
確認基準日: 2026-09-27