30 秒で分かる結論 ―― ChatGPT の llms.txt 対応
ChatGPT が llms.txt を読んでいる証拠はなく、OpenAI がそう言ったこともありません。OpenAI のクローラー説明ページは 4 種類のボットと、それぞれの robots.txt の扱いを説明していますが、他サイトの llms.txt を読むという記述は一切ありません。 2026 年に公開された第三者のサーバーログ報告でも、OpenAI のボットは robots.txt を数千回取りに来る一方で、llms.txt はほとんど取りに来ていません。
一方で、確かなことが 2 つあります。OpenAI は自社の開発者向けドキュメントに llms.txt を公開しており、ドキュメントを読むエージェント向けには 有用な形式だと考えていること。そして ChatGPT は OAI-SearchBot と ChatGPT-User を通じて、 ふつうの Web ページを大量に読みに来ていること。今 ChatGPT の回答に載るために 効いているのは、特別なファイルの有無ではなく、これらのボットを許可した上で プレーンな HTML として取得できることです。
実務上の結論はこうです。llms.txt は安くて他の読み手もいるので置く。 ただし ChatGPT の回答が変わることは期待しないし、見込みの数字にも入れない。
OpenAI が公式に書いていること
OpenAI はクローラーを説明するページを 1 つ公開しています(2026 年 9 月時点では 開発者向けドキュメント内の developers.openai.com/api/docs/bots)。そこに載っている User-Agent は 4 つです。
| ボット | 公式の説明 | robots.txt | サイト側にとっての意味 |
|---|---|---|---|
| OAI-SearchBot | ChatGPT の検索機能でサイトを表示するために使う | 従う。検索に出るには許可が必要 | ChatGPT 検索に載るかどうかを決めるボット |
| ChatGPT-User | ChatGPT やカスタム GPT でのユーザー操作に応じてページを取得 | ユーザー起点のため、適用されない場合がある | 回答時の訪問。クロールや検索への収録には使われない |
| GPTBot | 基盤モデルの学習に使う可能性のあるコンテンツをクロール | 従う。学習を拒否するなら Disallow | 学習用クローラー。検索への収録は OAI-SearchBot が担う |
| OAI-AdsBot | ChatGPT に広告として提出されたページの安全性を検証 | 広告のページにしか来ない | ChatGPT に広告を出さない限り無関係 |
このページで llms.txt という語を探すと、見つかるのは冒頭の 1 か所、 OpenAI 自身のドキュメント索引を指している行だけです。どのボットもあなたのサイトの このファイルを探すとは書かれておらず、置くようにという案内もありません。 なお OpenAI は各ボットの IP 範囲を機械可読な形で公開しており (openai.com/searchbot.json、chatgpt-user.json、gptbot.json)、ログのアクセスが本物かを確かめる手段はこちらです。
ボットの違いが重要な理由
ネット上の助言の多くは「ChatGPT」を 1 つのクローラーとして扱っています。 実際は役割の違う 3 つです。学習に使われたくないから GPTBot を 遮断するのは正当な選択です。OpenAI はこれを学習用クローラーと説明し、 検索への収録は OAI-SearchBot に結びつけているので、 ChatGPT 検索から外れるのは後者を遮断したときです。 そして ChatGPT-User は、人がそのページを求めているという理由で robots.txt を無視することがあります。 このどれも llms.txt とは関係がない、というのが要点です。
OpenAI が自社サイトで llms.txt をどう使っているか
OpenAI 自身は採用側です。2026 年 9 月 21 日に取得した developers.openai.com/llms.txt は約 6 KB・リンク 38 本のハブで、 API・Codex・プラグイン・Ads API・Cookbook などの分野別 llms.txt と、よくある作業への短いリンク集で構成されています。
# OpenAI Developers > Complete documentation hub for OpenAI API, Ads, Plugins, Workspace Agents, Codex, Agentic Commerce, the developer blog, Cookbook, learning resources, and learning tracks. Start with the product index that matches your task. Product indexes route to detailed pages; documentation indexes also provide Markdown pages and full-document exports. ## Documentation sets - [OpenAI API guides and reference](https://developers.openai.com/api/llms.txt): Quickstart, Responses API, ... - [Codex developer tools](https://developers.openai.com/codex/llms.txt): Codex CLI, IDE, cloud, config.toml, ... - [ChatGPT product documentation](https://learn.chatgpt.com/llms.txt): ChatGPT Work, administration, ... ## Common tasks - [OpenAI API quickstart](https://developers.openai.com/api/docs/quickstart.md): Make your first API request with the OpenAI SDK and Responses API.
ここは読み違えやすいところです。分かるのは、OpenAI が「エージェントや コーディングツールがドキュメントを辿る手段」として llms.txt を 有用だと考えていること。仕様書自身も、AI 各社が開発者向けドキュメントに このファイルを公開していると書いています。しかしそれは、ChatGPT という製品が あなたのドメインのファイルを読む、という話ではありません。 形式を提供することと、形式を消費することは別です。
サーバーログに見えること
OpenAI はクロールの統計を公開していないので、ボットが何を取りに来ているかの 証拠は、サイト運営者が自分のログで見たものしかありません。2026 年に公開された 報告のうち、手法と数字を明記している 2 本を挙げます。
- 83 サイト・12 週間のパネル調査(2026 年 7 月 27 日公開)。EZY.ai が
llms.txtを設置した 83 サイトを 2026 年 4 月 27 日から 7 月 19 日まで観測。OpenAI からのrobots.txtリクエスト 3,990 件に対し、llms.txtの取得は 7 件。Anthropic も同程度(3,120 件に対し 9 件)、 Perplexity はゼロで、定常的に取りに来ていたのは Meta のクローラー(193 件)だけでした。 - 1 サイト・14 日間のログ(2026 年 8 月 3 日公開)。Saaslinks が 2026 年 7 月 20 日から 8 月 3 日に記録した AI クローラーからの ページリクエストは 18 種類のボットで 151 件。そのうち約 9 割が
ChatGPT-UserとOAI-SearchBotでした。 AI クローラーによる/llms.txtのリクエストは、6 月から設置して いたにもかかわらずゼロ。
どちらもサンプルは小さく、ボットの識別は User-Agent 頼みなので、件数そのものは 幅を持って受け取ってください。ただ、2 本の結論は同じ方向を向いており、逆の報告 ―― OpenAI のボットが llms.txt を当たり前に取りに来ているログ ―― は公開されていません。
2 本目の報告は、もう半分の事実も示しています。ChatGPT はそのサイトを 無視しているのではなく、AI の中では最大の訪問者です。読んでいるのは索引ではなく、 ページそのものです。
ChatGPT は実際どうやってページを見つけ、引用しているか
以上を踏まえると、ChatGPT に対して効くのはごく普通の対策です。 2026 年 9 月時点で、OpenAI のドキュメントと観測される挙動から言えることを挙げます。
- robots.txt で OAI-SearchBot を許可する。OpenAI は、ChatGPT 検索に出るには許可が必要だと明記しています。 WAF の初期設定にありがちな「不明なボットを一括遮断」は、あなたを検索から外します。
- ChatGPT-User を遮断しない。回答時に、ユーザーが尋ねたページを取りに来るボットです。 取得できなければ、ChatGPT は記憶で答えるか、別のサイトを引用します。
- 読める HTML を返す。取得は素の HTTP リクエストです。クライアント側の重いレンダリングの後にしか 現れない内容、同意ダイアログの裏、PDF の中の内容は取りこぼされがちです。
- 引用できる文を書く。冒頭の段落が明確で、具体的な数字と日付があるページが、回答に持ち上げられます。 これは Perplexity や Google の AI Overviews に対する助言と同じです。
このリストに llms.txt が入っていないことに注目してください。 害はなく、書く過程でページ自体が良くなることも多いのですが、 OpenAI のボットが見ているものではありません。
それでも llms.txt を置くべきか
置くべきです。ただし期待値を正しく。置く理由は変わっておらず、 変わったのは「ChatGPT が読む」という主張の方です。
- コストがほぼゼロ。書くのに 30 分、あとはリンク切れを防ぐだけです。
- 他に読む者がいる。コーディングエージェントやドキュメントツールはこのファイルを辿ります。 仕様書は Chrome の Lighthouse が監査項目にしたと書いていますし、 上のログ調査では Meta のクローラーが定常的に取得していました。
- OpenAI が方針を変えても準備済み。対応は告知なしに始まりうるもので、始まれば数週間のログで分かります。
- 整理を強いる。重要ページを 1 文で説明する作業は、結果をどのボットが読むかに関係なく 役に立ちます。
やめるべきなのは、このファイルを ChatGPT 対策として扱うこと、 クライアントにそう約束すること、そして 1 週間 llms.txt の取得が なかったからといって「何か壊れている」と考えることです。 何も壊れていません。2026 年ではそれが通常の状態です。
AI クローラーから自分のサイトがどう見えるか確認する
URL を入れると、ボットと同じ方法でページを取得し、取得できた範囲を報告した上で、その内容から llms.txt の下書きを作ります。無料・登録不要。
診断を実行する →自分のログで確かめる方法
誰かの言葉を信じる必要はありません。アクセスログがあれば、自分のサイトについては 1 分で答えが出ます。
# OpenAI のボットからのリクエスト(全パス)
grep -Ei "OAI-SearchBot|ChatGPT-User|GPTBot" access.log | wc -l
# そのうち llms.txt を要求したものは?
grep -Ei "OAI-SearchBot|ChatGPT-User|GPTBot" access.log | grep -c "/llms.txt"
# ChatGPT が実際に取りに来ているパスは?
grep -Ei "OAI-SearchBot|ChatGPT-User" access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head1 つ目の数字がそれなりにあって 2 つ目がゼロなら、あなたのサイトは公開されている 調査と同じ状態です。怪しいアクセスは、OpenAI が公開している IP 範囲と照合して 確かめてください。User-Agent 文字列は簡単に偽装できます。
この結論が変わる条件
次のいずれかが起きたら、この記事は更新します。OpenAI がクローラー説明ページに llms.txt の扱いを明記する。公開されたログ調査で OAI-SearchBot や ChatGPT-User が定常的にこのファイルを 取得していると示される。ChatGPT が回答の中で llms.txt の URL を 直接引用し始める。それまでは、「ChatGPT は llms.txt を読んでいるのか」への 正直な答えは「誰も示せていない」です。
よくある質問
OpenAI は「ChatGPT が llms.txt を読む」と言ったことがありますか?
2026 年 9 月時点ではありません。OpenAI のクローラー説明ページは OAI-SearchBot・GPTBot・ChatGPT-User・OAI-AdsBot の 4 つを説明し、それぞれの robots.txt の扱いを書いていますが、他サイトの llms.txt を読むという記述はありません。OpenAI が llms.txt に触れているのは、自社の開発者向けドキュメント用に公開しているファイルの話だけです。
では、なぜ OpenAI 自身は llms.txt を公開しているのですか?
ドキュメントを読むエージェントやコーディングツールにとって便利な形式で、OpenAI のドキュメントはまさにそういう使われ方をするからです。developers.openai.com/llms.txt は、API・Codex・プラグインなど分野ごとの llms.txt にリンクするハブになっています。「OpenAI が形式を有用だと考えている」ことは分かりますが、「ChatGPT があなたのサイトの llms.txt を読む」ことにはなりません。
llms.txt を置けば ChatGPT の検索に載りますか?
載りません。ChatGPT 検索に表示されるかどうかは OAI-SearchBot が決めており、robots.txt で許可されていること、ページが通常の HTML として取得・解釈できることが条件です。llms.txt はどちらの代わりにもなりません。OAI-SearchBot を遮断していれば llms.txt があっても表示されず、許可していれば llms.txt はせいぜい小さな上乗せです。
OpenAI のボットは llms.txt をまったく取りに来ないのですか?
「ほとんど来ない」というのが、2026 年に公開されているサーバーログの報告から言えることです。83 サイトを 12 週間観測した調査では、OpenAI からの robots.txt リクエスト約 4,000 件に対して llms.txt の取得は 7 件。1 サイトを 14 日間観測した別の報告ではゼロでした。どちらも小さなサンプルですが結論は一致しており、OpenAI が llms.txt を定常的な取得対象にしている形跡はありません。
ChatGPT が読まないなら、llms.txt は置かなくてよいですか?
置く価値はあります。ただし「流入を増やす施策」ではなく「安い保険」として。作成は数十分で済み、読む側は他にもいます(同じログ調査では Meta のクローラーが定常的に取得しており、コーディングエージェントやドキュメントツールも使います)。Chrome の Lighthouse も監査項目にしています。OpenAI が後から対応しても、置いてあれば何もしなくて済みます。見込みの数字に入れないことだけ守ってください。
ChatGPT が自分のサイトに来ているかは、どう確認できますか?
アクセスログで OAI-SearchBot・ChatGPT-User・GPTBot の User-Agent を検索し、パスで絞って /llms.txt へのリクエストがあるかを見ます。本当に OpenAI からのアクセスかを確かめるには、openai.com/searchbot.json、openai.com/chatgpt-user.json、openai.com/gptbot.json で公開されている IP 範囲と照合します。
次に読む
- → Google は llms.txt を使うのか(Google 検索と AI Overviews について同じ問いを)
- → AI 検索に拾われたかを確認する方法(設置後 1 か月のチェックリスト。ログの見方も)
- → llms.txt と AI 検索の効果計測の仕方
- → 解説記事の一覧へ戻る