実践ガイド · 読了 6 分

AI 検索に拾われたか確認する方法

設置から 1 か月のチェックリスト。

llms.txt を公開し、検証ツールも通り、 robots.txt でクローラーをブロックしていないことも確認した後、 最初の 1 か月にやるべきことは「配管が機能していること」の確認です。 引用シェアを誇る段階ではありません。

これは私たち自身が運用しているチェックリストです。有料ツールも コードも要りません。それでも、小規模サイトで実際に AI 検索を妨げている 典型的な問題を見つけられます。

4 つのチェック項目

最初の 1 か月は、4 つすべてを週 1 回ずつ確認してください。 それ以降は月 1 回で十分です。各チェックが答える問いは 1 つだけです。

  1. 01

    ファイルは到達可能か?

    /llms.txt が正しいヘッダで配信されているかを確認するチェックです。AI 流入がゼロのとき、原因はコンテンツではなくファイル不通であることがほとんどです。

  2. 02

    AI ボットは取得しに来ているか?

    ChatGPT の GPTBot、Anthropic の ClaudeBot、Perplexity の PerplexityBot が実際にアクセスしているかを確認するチェックです。来ていないなら、まずそこを直してください。

  3. 03

    引用はされているか?

    手動で直接確かめるチェックです。自社の顧客が聞きそうな質問を AI に投げ、引用元リストに自社が出るかを見てください。

  4. 04

    AI 経由で誰か来ているか?

    chat.openai.com、claude.ai、perplexity.ai などからの参照流入を見るチェックです。参照流入は、引用が訪問につながった証拠です。

Check 1. ファイルは到達可能か?

やること: シークレット/プライベートウィンドウで https://yoursite.com/llms.txt を開いてください。 次に開発者ツール(F12)の Network タブを開き、リロードしてください。

確認すること:

  • ステータスコードは 200。301 でも 404 でもなく、 リダイレクトチェーンも挟まないことを確認してください。
  • Content-Type は text/plain または text/markdown。application/octet-stream になっていると、 一部の AI クローラーがスキップします。
  • Markdown がプレーンテキストとしてブラウザに表示される。HTML としてレンダリングされたり、ダウンロードが始まったりしないことを 確認してください。
  • 本サイトの検証ツールで仕様違反ゼロ。 直したと宣言する前に必ず通してください。

典型的な不具合:

  • http:// から https:// への 301 リダイレクトを、 一部の AI クローラーが追えない
  • CDN 設定の不備で Content-Type が剥がれている
  • SPA がリクエストを横取りして、ファイルではなく HTML シェルを返している

Check 2. AI ボットは取得しに来ているか?

やること: サーバーのアクセスログ(または CDN ログ)を、 次の User-Agent 文字列で grep してください。

GPTBot/         (OpenAI / ChatGPT browsing)
ChatGPT-User/   (ログイン中の ChatGPT ユーザーがアシスタント経由で閲覧)
ClaudeBot/      (Anthropic / Claude)
PerplexityBot/  (Perplexity)

Google-Extended と Applebot-Extended は 意図的に外しています。この 2 つは User-Agent 文字列ではなく、robots.txt 用の制御トークンです。Google と Apple は通常の Googlebot と Applebot の User-Agent でクロールするため、この 2 つの名前は アクセスログに現れません。許可しているかどうかは robots.txt で確認してください。

確認すること:

  • 公開から 7 〜 14 日以内に、主要ボットそれぞれ最低 1 回のフェッチ。GPTBot が最も早く現れる傾向があり、ClaudeBot と PerplexityBot がそれに続きます。
  • llms.txt 内の URL も同じボットが取得しに来ている。ファイル単体ではなく、リストの中身も AI が読んでいるシグナルです。
  • ステータスは 2xx。AI ボットへの 4xx や 5xx は、 気づかないうちに引用ファネルを壊します。

2 週経ってもボットが来ていない場合:

  • robots.txt に User-agent: GPTBot や User-agent: ClaudeBot 配下で意図せず Disallow: / を入れていないか
  • Cloudflare やファイアウォールの「Block AI Scrapers」ルールが 有効になっていないか。多くの WAF はこのルールをデフォルトで有効にしています。
  • ペイウォール、ジオフェンス、ログインウォールの後ろに置かれていて、 AI ボットが越えられない構造になっていないか
  • Content-Type に問題がないか。もう一度確認してください。 AI ボットはブラウザより MIME タイプに厳しいです。

Check 3. 引用はされているか?

やること: 自社の顧客が実際に聞きそうな質問を 5 〜 10 個選び、 ログアウト状態のブラウザで次のアシスタントに投げてください。

  • ChatGPT(ブラウジング ON)
  • Claude(Web 検索 ON)
  • Perplexity
  • Google AI Overviews(通常の Google 検索でよい)
  • 任意: Copilot、Brave AI、You.com

クエリとアシスタントの組み合わせごとに、次の 3 つを記録してください。

  • 引用元リストに自社が出たか(yes / no)
  • 引用順位(1 番目、2 番目、…)
  • 拾われた文言は誰のものか(自社、競合、AI による要約のいずれか)

1 か月目の「正常」目安:

  • 指名検索(「<自社名>」「<自社名> 料金」)では、すぐに出るはずです。 出ないなら、引用シェア以前に llms.txt や各ページタイトルに問題があります。
  • ミドルテールクエリ(「東京 社労士」「造園会社向け CRM」)では、 4 〜 5 アシスタントのうち 0 〜 3 件の引用が現れる程度が初月の目安です。 引用はコンテンツの厚みと時間に応じて積み上がります。
  • ヘッドクエリ(「best CRM」「税務ソフト」)では、初月に引用を期待しないでください。 既存大手が枠を独占しています。ミドルテールクエリが主戦場です。

Tip: シークレットウィンドウを使い、可能なら別の IP からも 実行してください。ログイン状態のセッションでは回答がパーソナライズされ、 監査結果が歪みます。

Check 4. AI 経由で誰か来ているか?

やること: 解析ツール(GA4、Plausible など)で 参照元別のセッションを見て、次のドメインでフィルタしてください。

chat.openai.com    chatgpt.com
claude.ai
perplexity.ai      www.perplexity.ai
copilot.microsoft.com
gemini.google.com
search.brave.com
you.com

確認すること:

  • 絶対値ではなくトレンド。 1 週目に 5 セッション、4 週目に 25 セッションなら強いシグナルです。 1 週目も 4 週目も 25 セッションなら横ばいで、効果は出ていません。
  • ランディングページ。AI 流入はトップページに着地することがほぼなく、 質問に答える特定のページに直接ランディングします。llms.txt で列挙したページに流入が集中していれば、 正しいページが届いているサインです。 そうなっていないなら、llms.txt の説明文が一般的すぎる可能性が高いです。
  • サイト内行動。AI 流入は、短時間で意図の強いセッションが普通です。 1.2 ページ/セッション、滞在 60 秒前後は健全な範囲です。 訪問者は AI の回答ですでに文脈を得ているためです。

パターン別の診断

ボットは来ている、でも引用されない

大半はコンテンツの問題で、配管の問題ではありません。llms.txt に列挙したページは技術的には到達可能でも、 ユーザーの質問に答えていない状態です。 自社ではなく 競合 を引用した AI の回答で、引用スニペットを見比べてください。 競合のページにあって自社ページにないものを探します。 たとえば、具体的な数字、名指しの比較、明確な所在地と対象顧客です。 足りていないものを補ってください。

引用はされているが、流入がない

可能性は 2 つあります。(1) AI が回答内で質問に答えきっていて、 ユーザーがクリックする必要がない場合です。 この場合でも、引用にはブランド露出としての価値があります。 (2) 引用が長いソースリストの後ろの方に埋もれていて、 ユーザーが上位しかクリックしない場合です。 この場合の打ち手は、1 〜 2 番目に引用されることです。 そのためには多くの場合、そのクエリに対してネット上で最も具体的なページになる必要があります。

流入はあるが、コンバージョンしない

原因はほぼ常にランディングページのミスマッチです。 AI は質問に答えるページへユーザーを送り込んでいますが、 そのページに次のアクションへ進む導線がありません。 AI 流入が多いページに明確な CTA(予約リンク、登録フォーム、連絡先)を足して、 再計測してください。

何も動いていない

Check 1 をやり直してください。何も動かないときに最も多い原因は、/llms.txt が実は配信されていないか、 Content-Type が違うかのどちらかです。 よくあるのは次のような事例です。ファイルはリポジトリにあり、 Cloudflare のキャッシュも 200 を返しているのに、AI ボットには 404 が返っています。 原因は Next.js の動的ルートとのパス衝突です。 必ず AI ボットの視点で確認してください。ターミナルで curl -A "GPTBot" を実行し、 実際のレスポンスを目で確認してください。

よくある質問

ChatGPT が本当に自社サイトに来ているか、どう確認しますか?

サーバーのアクセスログを User-Agent 「GPTBot」(OpenAI のクローラー)と「ChatGPT-User」(ログインユーザーが ChatGPT 経由で明示的に閲覧したときに付く)で grep してください。多くのサイトでは、llms.txt 公開から 1 週間以内に最低 1 回の GPTBot のフェッチが現れます。出ない場合は、(1) robots.txt で GPTBot をブロックしていないか、(2) /llms.txt が HTTP 200 で、Content-Type が text/plain か text/markdown で配信されているかを確認してください。

Perplexity では引用されるのに ChatGPT では引用されません(逆もあります)。なぜですか?

AI ごとに retrieval パイプラインが違います。Perplexity はリアルタイム AI 検索に近く、最近公開された構造の整ったコンテンツを引用しがちです。ChatGPT のブラウジングはより保守的で、権威性の高いサイトを優先する傾向があります。AI ごとに結果がばらつくのは普通です。最初の半年は、どの AI でも同じように引用されるとは期待しないでください。アシスタントごとに別々に追ってください。

引用はされますが、原文ではなく言い換えで紹介されています。これでいいんですか?

それで大丈夫です。言い換えは最も一般的な引用形態です。AI があなたのページを取り込み、自分の言葉で要約して、引用元リストに加えた状態です。リンクと引用クレジットは得られています。原文そのままの引用も起きますが、言い換えより稀です。統計値、定義、名前のついた手法のような固有の言い回しがあるときに起きやすくなります。

Google AI Overviews が引用したかどうかは Search Console で見えますか?

2026 年時点では直接は見えません。AI Overviews での表示とクリックは、対応するクエリの通常の Search Console データに合算されます。引用されたページは、表示数が増えてもクリックはそれほど増えない傾向があります。回答が検索結果ページにそのまま表示されるためです。AI Overviews が答えていると分かっているクエリのトレンドラインを見比べると、影響をおおよそ逆算できます。

引用監査(citation check)はどれくらいの頻度で行えばよいですか?

最初の 1 か月を過ぎたら、ほぼすべてのサイトで月 1 回が適切です。AI の回答は Google 順位より動きが遅く、検索順位よりノイズが多いため、週次で確認を続けてもノイズばかりが目立ちます。新しい料金ページの公開、新製品のリリース、ドキュメントの再構成のような大きな変更をしたときは、公開の 2 〜 3 週後に追加のチェックを 1 回挟んでください。

AI の回答に一切出てきません。どうすればよいですか?

まず基本を確認してください。llms.txt に到達できるか、robots.txt で AI ボットをブロックしていないか、関連ページがクロール可能かの 3 点です。次に、テストしているクエリを疑ってください。「best CRM」のような汎用クエリで既存大手と争うのは困難です。「テキサス州の造園会社向け CRM」のような具体的なミドルテールクエリに移ると、引用枠を獲りやすくなります。引用シェアは、ミドルテールクエリを 1 つずつ積み上げて作るものです。