インディーハッカー道
Google と ChatGPT、新しいサイトに人を連れてくるのはどちらが先か|クローラーの記録を1か月並べてみた
マーケティング

Google と ChatGPT、新しいサイトに人を連れてくるのはどちらが先か|クローラーの記録を1か月並べてみた

·10分で読める
平城寿
平城 寿(ひらじょう ひさし)
@SOHO創業者 / インディーハッカー

この記事のポイント

  • ✓2026年の夏に立ち上げた9つのサイトで
  • ✓Google と ChatGPT のボットがいつ来て
  • ✓いつ人を連れてきたかを記録で並べました

新しいドメインでサイトを開くと、Google 検索から人が来るまでには時間がかかります。 検索結果に出るまで数週間、上位に出るまでは数か月かかるのがふつうです。

では、ChatGPT はどうでしょうか。

私たちは2026年の夏に、自社製品のサイトを9つ、新しいドメインで立ち上げました。 その記録を並べてみると、Google 検索から人が来るのを待っている間に、ChatGPT からは人が来て、会員登録まで進んでいました。 しかも、Google 検索からほとんど人が来なくなった時期にも、ChatGPT からは来続けていました。

この記事では、その記録を時刻の順に並べます。 最後に、新しいサイトで ChatGPT から人を集めるためにやったほうがよいことをまとめます。

調べたもの

9つのサイトは、どれも製品の案内とブログ(使い方や比較の記事)でできています。 業務向けのクラウドサービス、Mac のアプリ、グループの連絡や予約の道具など、分野はばらばらです。 日本語と英語の両方のページがあるサイトと、日本語だけのサイトがあります。 ここでは製品名を伏せ、サイトA〜Iと呼びます。

使った記録は3種類です。

  • サーバーのアクセス記録(4つのサイトはドメインを取った日から残っている)
  • Cloudflare の集計(残りの5つ。9月11日より前は取れない)
  • Google アナリティクス(9つすべて。人の来訪の数と、どこから来たか)

時刻はすべて日本時間です。 ボットは、アクセスのときに名乗る名前(User-Agent)で分け、各社が公開している IP アドレスの一覧と照らし合わせて本物だけを数えました。

登場するボット

  • Googlebot:Google 検索のためにページを集める
  • OAI-SearchBot:ChatGPT の検索機能のためにページを集める
  • ChatGPT-User:利用者が ChatGPT に質問したとき、その場でページを読みに来る
  • GPTBot:OpenAI の生成 AI の学習のためにページを集める

OpenAI のボットの役割は、OpenAI の説明に書かれています。 https://developers.openai.com/api/docs/bots

この記事でいちばん大事なのは ChatGPT-User です。 ChatGPT-User は Web を自動で巡回するものではなく、だれかが ChatGPT に質問したときに、そのつど読みに来ます。 ChatGPT-User が来たということは、その時刻にだれかが ChatGPT に何かを聞いていた、ということです。

最初に来たのはいつか

サイトAの記録を、ドメインを取った日から時刻の順に並べました。

サイトAに最初に来たボットと人のタイムライン

順に見ていきます。

8月29日の未明にドメインを取り、3時09分に SSL 証明書が発行されました。 SSL 証明書の発行は、Certificate Transparency という公開の記録に載り、だれでも見られます。

その1時間後の4時08分、2秒の間に4つのボットがトップページに来ました。 そのうち1つは、名前のとおり証明書の公開記録を見張るボット(CertSignalBot)です。 新しいドメインや新しい証明書を拾って、自動で巡回を始める仕組みが世の中にあるということです。 Ahrefs などで被リンクを調べると、見知らぬ海外のサイトからのリンクがたくさん出てきますが、その多くも同じように新しいドメインを自動で拾って一覧に載せるサイトです。

ChatGPT の検索用のボット(OAI-SearchBot)は、その20分後の4時27分に来ています。 Googlebot が初めて来たのは2日後の8月31日、Bing のボットは5日後の9月3日でした。 この時点では、記事もプレスリリースも被リンクもありません。

同じくサーバーの記録が残っているサイトBでも、OAI-SearchBot はドメインを取った約2時間後に来ていました。 一方サイトDでは、Googlebot が先でした。 どちらが先に来るかはサイトによって違いますが、どちらもドメインを取ってから数日以内に来ています。

ChatGPT は Google や Bing を通して見つけているのか

ChatGPT の検索は Bing を使っている、という話を聞いたことがある人も多いと思います。

サイトAとサイトBの記録では、OAI-SearchBot は Googlebot よりも Bing のボットよりも先に来ていました。 少なくとも新しいサイトを見つける段階では、ChatGPT は Google や Bing の検索結果を待たず、自分のボットで見に来ています。

何を見てサイトを知ったのかは、OpenAI が公表していないので分かりません。 記録から言えるのは、証明書の公開記録を見張るボットが来た20分後に、OAI-SearchBot が来ていたということだけです。

一方、ChatGPT が質問に答えるときに、どこからページを探しているのかは、この記録からは確かめられません。 サイトAでもサイトBでも、ChatGPT-User が初めて来たのは、Bing のボットが初めて来たあとでした。

最初は戸口を見ていくだけ

ここで1つ、気をつけたいことがあります。 OAI-SearchBot は8月29日から9月3日まで毎日1回から6回来ていましたが、読んでいたのは robots.txt だけでした。 robots.txt は、そのサイトのどこまでボットが入ってよいかを書いた案内のファイルです。 入ってよいかを確かめて、中には入らずに帰っていたことになります。

9月2日に記事を出し始めると、9月4日の0時44分に、初めて記事を読みました。 その日のうちに56回来ています。

サイトIでは、もっとはっきりした差が出ました。 サイトIのドメインは5月からあり、OAI-SearchBot は5月から来ていました。 ところが、ChatGPT-User が初めて来たのは、記事を出し始めた6日後の9月8日です。 中身が無いうちは、ChatGPT の答えに使われることもありませんでした。

ChatGPT は最初の1回で見切るのではなく、毎日戸口まで来て、中身ができたら読む、という動きでした。

ChatGPT は、読んだ直後に人が来る

サイトAに ChatGPT から初めて人が来たのは、9月4日の12時18分です。 ドメインを取ってから6日後、記事を出し始めてから2日後でした。

このときの記録には、ChatGPT-User がトップページを読んだ4秒後に、chatgpt.com から人が来た並びが残っています。

会員登録まで進んだ例も、同じ並びでした。

ChatGPT が読んでから人が来て登録するまで

9月14日の例です。

  • 14時22分06秒:ChatGPT-User がトップページを読む
  • 14時23分37秒(91秒後):chatgpt.com から人が来る
  • 14時23分43秒:登録の画面を開く
  • 14時24分15秒(2分09秒後):会員登録が終わる

9月25日の例です。

  • 5時05分22秒:ChatGPT-User がトップページを読む
  • 5時06分37秒(75秒後):chatgpt.com から人が来る
  • 5時06分42秒:登録の画面を開く
  • 5時07分32秒(2分10秒後):会員登録が終わる

ChatGPT-User が読んだことと人が来たことが、同じ人の質問から起きたかどうかは、記録からは確かめられません。 言えるのは、ChatGPT がページを読み、1分ほどのうちに ChatGPT から人が来て、そのまま登録まで進んだ並びが実際にあった、ということです。

サイトAでは、10月9日の時点で、Google 検索から来た人の会員登録はまだ0件でした。 ChatGPT から来た人の登録は、この2件を含めて3件ありました。

Google は、読んでから人が来るまでに段階がある

Google が遅いのは、ボットが来るのが遅いからではありません。 サイトAにも、Googlebot はドメインを取った2日後に来て、その後は毎日数十回から数百回、ページを読んでいます。

Google 検索の仕組みは、Google 自身が3つの段階で説明しています。 ページを集める(クロール)、中身を整理して登録する(インデックス)、検索結果に出す、の3つです。 https://developers.google.com/search/docs/fundamentals/how-search-works

人が来るのは、検索結果に出て、そこでだれかがリンクを押したときです。 新しいサイトは、読まれてから検索結果の上のほうに出るまでに時間がかかります。

ChatGPT では、読むことと人に紹介することが、1つの質問の中で起きます。 だれかが質問し、ChatGPT がその場でページを読み、答えの中でリンクを示す。 そのため、読んでから数秒から数分で人が来ます。

Google から消えた時期も、ChatGPT からは来続けた

9つのサイトの来訪を、同じ長さの8日間ずつで比べました。 9月25日から10月2日までと、10月3日から10月10日までです。

9サイトの Google 検索とAIからの来訪

サイトA・B・Cは、10月3日に Google 検索からほとんど人が来なくなりました。 Google の9月のスパムアップデートの期間と重なります(このことは別の記事に書きました)。 https://zenn.dev/hirajo/articles/google-spam-update-new-site

この3サイトでも、ChatGPT などAIからの来訪は、15人から7人、14人から13人、11人から7人と、続いていました。 Google での扱いが変わっても、ChatGPT はそれとは別にサイトを読み、人に紹介しています。

9サイト全体では、AIからの来訪は85人から135人に増えました。 ただし、増えた分のほとんどはサイトDです。 数の大きさで言えば、Google 検索から来る人のほうがまだずっと多く、9サイト合計で AI の4倍から8倍です。 ChatGPT が Google の代わりになる、とまでは言えません。 言えるのは、Google から人が来ない立ち上げの時期にも、ChatGPT からは人が来るということです。

ChatGPT から来た人は、どこに着いたか

9つのサイトで、ChatGPT から来た人が最初に開いたページを数えました(9月1日から10月10日まで、257人)。

  • ブログの記事:189人(74%)
  • トップページ:48人(19%)
  • 料金などそのほかのページ:20人(8%)

4人に3人は、記事に着いていました。 サイトDでは、1本の記事(LINE グループで特定の人だけに連絡する方法)だけで24人来ています。 ChatGPT は、利用者の質問に答えるページとして記事を選び、そこに人を連れてきています。

ChatGPT から人を集めるための手順

ChatGPT などの AI に紹介されるための工夫は、LLMO(大規模言語モデル最適化)と呼ばれます。 ここまでの記録から、新しいサイトでやったほうがよいことをまとめます。

1. 公開の初日から、ChatGPT のボットを止めない

OAI-SearchBot は、ドメインを取った当日に robots.txt を見に来ました。 ここで断ると、そのあと中身を作っても読みに来る理由がありません。

ブラウザで https://あなたのドメイン/robots.txt を開き、OAI-SearchBot や ChatGPT-User に、あるいは User-agent: * に Disallow: / が書かれていないかを確かめます。 OpenAI の説明では、OAI-SearchBot を止めたサイトは、ChatGPT の検索の答えに出なくなります。 学習用の GPTBot と、検索用の OAI-SearchBot は別々に設定できるので、学習には使われたくなくても、検索用は通しておけます。

robots.txt のほかに、CDN やサーバーのボット対策で AI のボットを止めていないかも見てください。

2. 読めるページがそろってから公開する

サイトAでは、記事を出し始めた2日後に OAI-SearchBot が記事を読み始め、その日のうちに人が来ました。 サイトIでは、ドメインが5月からあっても、記事が無いうちは ChatGPT の答えに使われていませんでした。

「準備中」のページだけでドメインを公開しても、ChatGPT は戸口を見て帰るだけです。 製品の説明のページと、読者の質問に答える記事が数十本ある状態で公開すると、最初の1週間から ChatGPT に紹介される見込みが出ます。

3. 利用者が ChatGPT に聞きそうな質問に、1ページで答える

ChatGPT から来た人の4人に3人は、記事に着いていました。 それも、製品の宣伝の記事ではなく、「LINE グループで特定の人だけに連絡する方法」「Google フォームの回答を締め切る方法」のような、利用者が困ったときに聞く質問に答える記事です。

ChatGPT はだれかの質問のたびに、その答えになるページを探しに来ます。 製品が解決する困りごとを、質問の形で1つずつ記事にしておくと、そこが入口になります。

4. 記録で確かめる

ChatGPT から人が来ているかは、2つの場所で確かめられます。

1つは Google アナリティクスです。 ChatGPT の答えの中のリンクから来た人は、参照元が chatgpt.com になり、着地した URL の末尾に utm_source=chatgpt.com が付いていることが多くあります。

もう1つはサーバーのアクセス記録です。

grep "OAI-SearchBot" access.log | wc -l
grep "ChatGPT-User" access.log | wc -l

ChatGPT-User が記録にあれば、だれかが ChatGPT に質問して、ChatGPT があなたのサイトを読みに来たということです。 その直後に utm_source=chatgpt.com の付いたアクセスがあれば、その質問から人が来ています。

名前だけならどのプログラムでも名乗れるので、本物かどうかは、OpenAI が公開している IP アドレスの一覧と照らし合わせます。 一覧の場所は、上で紹介した OpenAI の説明のページに載っています。

おわりに

新しいサイトが Google に認識され、検索から人が来るようになるまでには時間がかかります。 その間、ChatGPT は Google や Bing を待たずに自分のボットでサイトを見に来て、中身ができると読み、質問した人をその場で連れてきました。

ドメインを取ったら、まず robots.txt で ChatGPT のボットを止めていないかを見てください。 そして、読者の質問に答えるページをそろえてから公開してください。 Google を待っている間にも、ChatGPT からは人が来ます。

シェア
#ChatGPT#LLMO#Googlebot#クローラー#AI検索
平城寿
平城 寿(ひらじょう ひさし)
インディーハッカー。2004年に@SOHOを創業し、20年間1人で運営。
フォロー

関連記事