
ChatGPTからの流入が会員登録の4人に1人になった。@SOHOでいつ何を変えてきたか
この記事のポイント
- ✓4月は新規会員のうちChatGPT経由が3.7%でした
- ✓9月は26日までで24.5%
- ✓直近の1週間では3人に1人です
@SOHO は、2004年から運営している日本のクラウドソーシングです。
ここ数週間、会員登録のうち ChatGPT から来た人が目に見えて増えています。 週ごとの割合と、サイトに入れてきた変更を日付つきで並べておきます。


| 月 | 会員登録に占める ChatGPT 経由の割合 |
|---|---|
| 4月 | 3.7% |
| 5月 | 10.6% |
| 6月 | 14.5% |
| 7月 | 15.3% |
| 8月 | 13.3% |
| 9月(1日〜26日) | 24.5% |
9月21日からの週(26日までの6日間)は33%でした。 3人に1人です。
Perplexity・Gemini・Copilot・Claude は、この期間を合わせても登録全体の1.4%です(ChatGPT は14.6%)。 ほぼ全部が ChatGPT です。
最初は数字が見えていなかった
いちばん手こずったのは、数えるところでした。
@SOHO では4月4日から、会員が最初にどこから来たかを残しています。 初めて来たときのリファラと着地URLを Cookie に30日間持たせ、会員登録のときに会員の情報へ書き込む作りです。
ここで2つ、つまずきました。
1. ChatGPT が X として数えられていた
流入元は、リファラに決まったドメインが含まれるかで判定していました。
ところが chatgpt.com には、X の短縮URLのドメインである t.co という文字列が入っています。
そのため ChatGPT からの訪問が X からの訪問として数えられていました。
4月18日に直しました。
2. ChatGPT からの訪問は、多くがリファラを送ってこない
4月以降の ChatGPT 経由の登録のうち、3分の2はリファラがありませんでした。
代わりに、ほぼ全員(98%)の着地URLに ?utm_source=chatgpt.com が付いていました。
ChatGPT が回答の中のリンクに付けているものです。
管理画面はリファラだけで流入元を判定していたので、この人たちは「不明」になっていました。
8月24日に、着地URLの utm_source を先に見るように変えました。
着地URLそのものは最初から保存していたので、この記事の数字は管理画面の表示ではなく、元の記録から数え直したものです。
自分のサイトで確かめるときは、リファラだけでなく着地URLを見てください。
入れてきた変更(日付順)
3月16日〜28日
- サイトマップと robots.txt を置いた
- すべての種類のページに構造化データを入れた(記事、パンくず、よくある質問、求人)
- ブログ記事の冒頭に「この記事のポイント」の要約を置き、著者とよくある質問を JSON-LD で出した
- Bing Webmaster Tools に登録し、新しいURLを IndexNow で送るようにした
- よくある質問のページを作った
- 3月28日、robots.txt で AI のクローラを名前を挙げて許可した
robots.txt のその部分は、いまこうなっています。
User-Agent: GPTBot
User-Agent: ChatGPT-User
User-Agent: OAI-SearchBot
User-Agent: ClaudeBot
User-Agent: Claude-SearchBot
User-Agent: Claude-User
User-Agent: PerplexityBot
User-Agent: Google-Extended
Allow: /
Disallow: /_admin/
Disallow: /api/ChatGPT-User は、利用者が ChatGPT に質問したときに、ChatGPT がページを読みに来るためのものです。
OAI-SearchBot は ChatGPT の検索のための収集、GPTBot は学習用の収集です。
3つは別のボットで、1つを止めても残りは止まりません。
4月4日
会員が最初にどこから来たかを残し始めた(上に書いたもの)。
7月9日
- すべての記事の下に、監修者、公開日と最終更新日、編集方針へのリンクを出した
- 編集方針のページと、運営会社のページを作った
- 構造化データの
dateModifiedが公開日のまま止まっていたのを直した
一覧のページに CollectionPage と ItemList の構造化データを入れた。
9月20日
- サイトの直下に
llms.txtを置いた。サイトの中に何があり、どこが何のためのページかを、短い文章でまとめたもの - 募集が終わった求人には、機械向けに掲載日だけを出すようにした。募集中の求人は、これまでどおり
JobPostingをすべて出している
どれも普通のことで、特別な手は使っていません。
ChatGPT は人をどこへ送ってくるか
ここは予想していませんでした。
4月と5月は、ChatGPT から来た人の多くがブログ記事に着地していました。 6月からは、個々の求人のページに着地するようになりました。
| 月 | ブログ記事に着地 | 求人に着地 | その他 |
|---|---|---|---|
| 4月 | 80% | 0% | 20% |
| 5月 | 53% | 13% | 33% |
| 6月 | 12% | 73% | 15% |
| 7月 | 33% | 57% | 10% |
| 8月 | 16% | 61% | 23% |
| 9月 | 10% | 71% | 19% |
(各月の ChatGPT 経由の登録を、最初に着地したページで分けた割合)
仕事を探している人が ChatGPT に聞き、ChatGPT が具体的な求人を示している、ということです。 検索エンジンが記事へ人を送る形より、求人サイトの検索窓に近い使われ方です。
JSON-LD はすべてのページに
サイトのすべての種類のページに JSON-LD を入れ、中身が正しい状態を保っています。
求人は、募集中のあいだは JobPosting を出し、応募の期限や在宅でできることも載せています。募集が終わった求人は、募集中のようには見せません。
ブログ記事には、公開日と更新日を正しく持たせた Article と、質問と答えがある記事には FAQPage を出しています。
分からないこと
どの変更が効いたのかは、分かりません。
週ごとのグラフを見ると、どの変更の翌週にも段差はありません。 上下に揺れながら少しずつ増え、直近の2週がこれまでで一番高くなっています。
言えるのは、3月の終わりからこれらのボットがサイトを読める状態にしてあったこと。 そして ChatGPT から人が来始めたとき、すでに流入元を残していたので、あとから正しく数え直せたことです。



