llms.txtは、AIエージェントや大規模言語モデル(LLM)に向けて、サイトの概要と読むべきページへのリンクをMarkdownでまとめたファイルです。サイトのルートに/llms.txtとして置き、エージェントはそこを入口に必要なページだけを読みに行きます。2024年9月3日にAnswer.AIのJeremy Howard氏が提案し、2026年8月に第2版(v2)へ改訂されました。
名前がrobots.txtに似ているため「AIクローラーの学習を拒否するファイル」と説明されることがありますが、仕様にallowやdisallowのようなアクセス制御の構文はありません。AIクローラーに収集をやめるよう指示するなら、使うのはrobots.txtです。本記事では仕様の原文に沿って、書き方と設置方法、v2で変わった点、Googleが「検索では使わない」とした効果の実態を整理します。
まとめ:llms.txtで先に押さえる要点
- アクセス制御のファイルではありません。llms.txtはAI向けの案内板で、どのページを読めば要点がわかるかを示すだけです。学習の拒否やクロールの制限はrobots.txtで行います。
- 必須はH1のサイト名だけです。その下に引用ブロックの要約、補足の文章、H2で区切ったリンク一覧を、この順番で書きます。
- 2026年8月のv2で仕様が広がりました。
/docs/llms.txtのようなサブパスへの設置の意味が定義され、HTTPのLinkヘッダーでMarkdown版ページとllms.txtの場所を知らせる方法が加わりました。 - Google検索には効きません。Googleは生成AI機能向けの公式ガイドで、Google検索はllms.txtを使っておらず、置いても可視性や順位は上がりも下がりもしないと明記しています。
- 効くのはエージェントが読みに来る場面です。APIドキュメントやSDKのように、コーディングエージェントが仕様を調べに来るサイトでは置く価値があります。集客目的のコーポレートサイトやメディアでは優先度は低く、保守できないなら置かない方が安全です。
llms.txtの定義と提案の経緯
仕様を公開しているのはllmstxt.orgで、原文はGitHubのAnswerDotAI/llms-txtリポジトリで管理されています。v2の本文は目的を「LLMが扱いやすい内容を提供するため、ウェブサイトに/llms.txtというMarkdownファイルを追加する」と定めています。ファイルには短い背景説明、利用上の注意、詳しいMarkdownファイルへのリンクを載せます。
提案の背景にあるのは、HTMLのページがエージェントにとって読みにくいという問題です。ナビゲーションや広告、JavaScriptを取り除いて本文だけを取り出す処理は精度が安定せず、サイト全体を読み込むにはコンテキストウィンドウが足りません。そこで、要点と読むべきページを1か所にまとめ、詳細はリンク先で必要なときだけ取得させる設計になっています。
仕様は、ページごとにMarkdown版を同じURLで用意することも併せて提案しています。page.htmlに対してpage.html.md、または拡張子を置き換えたpage.mdを置く形です。llms.txtのリンク先をこのMarkdown版にしておくと、エージェントは装飾のない本文を直接読めます。
用途について、原文は学習(training)よりも推論(inference)での利用を想定していたと書いています。利用者がエージェントに質問し、エージェントがその場で調べに行くときの入口という位置づけです。v2の改訂履歴で提案者は、ドキュメント基盤が自動生成するようになり、コーディングエージェントが安定して使うようになったと述べています。
robots.txt・sitemap.xmlとの違い
3つのファイルはどれもサイトのルートに置く慣習を共有していますが、役割は重なりません。仕様の原文もrobots.txtとllms.txtは目的が異なると明記しており、llms.txtは「許可された内容に文脈を与えることでrobots.txtを補完できる」という関係です。
| 項目 | llms.txt | robots.txt | sitemap.xml |
|---|---|---|---|
| 読み手 | AIエージェント・LLM | クローラー全般 | 検索エンジン |
| 伝える内容 | 要点と読むべきページ | クロールの許可・拒否の指示 | 検索エンジンに知らせたいURL |
| 形式 | Markdown | 独自の行形式 | XML |
| 掲載範囲 | 厳選したページ・外部URLも可 | パス単位の規則 | 掲載対象として選んだURL |
| 標準化 | 提案段階の仕様 | RFC 9309 | sitemaps.org |
| 学習用収集の拒否 | できない | 対応クローラーへ指示できる | できない |
sitemap.xmlで代わりにならない理由として、仕様は3点を挙げています。Markdown版のURLが載っていない場合が多いこと、理解に役立つ外部サイトのURLを含まないこと、掲載文書の合計が大きくなりやすくLLMのコンテキストに収まらないうえ不要な情報も多く含むことです。
OpenAIのGPTBotやAnthropicのClaudeBotに収集をやめさせたい場合は、robots.txtにUser-agentごとのDisallowを書きます。GoogleのGoogle-Extendedは独自のクローラーではなく、既存のGoogleクローラーが集めた内容をGeminiの学習などに使わせるかを決める制御用のトークンです。robots.txtはクローラーに遵守を求める取り決めで、アクセスを強制的に遮断する仕組みではない点も押さえておきます。どのボットを止めるとAI検索への掲載にどう響くかは、robots.txtとは?クロール制御の書き方と効く場面・不要な場面【2026年時点】で扱っています。
llms.txtの書き方と記述例
llms.txt仕様が定める要素と並び順
llms.txtはMarkdownで書きますが、決まった順番で要素を並べるため、正規表現やパーサーでも機械的に読み取れます。仕様が定める構成は次のとおりです。
- H1(
#)でプロジェクト名またはサイト名を書く。必須はこの1行だけ - 引用ブロック(
>)で、ファイル全体を理解するのに必要な要約を書く - 見出し以外の段落や箇条書きで、補足説明や読み方の注意を書く(0個以上)
- H2(
##)で区切った「ファイルリスト」を置く(0個以上)。各行は[名前](URL)のリンクが必須で、その後に:と説明を続けてもよい
H2の見出し名は自由です。慣習として## Optionalという節を設け、コンテキストが足りないときに読み飛ばしてよい二次的なリンクを入れます。ファイルの先頭にBOM(バイト順マーク)があっても構いません。
コーポレートサイトを想定した記述例
次の例は、受託開発の会社がサービスと実績、会社情報を案内する場合の書き方です。リンク先は各ページのMarkdown版にしています。
# Example Inc.
> Example Inc.は東京の受託開発会社です。業務システムとWebアプリの設計・開発・保守を扱います。
- 対応言語は日本語と英語です。
- 料金は案件ごとの見積もりで、公開価格はありません。
## サービス
- [業務システム開発](https://example.com/services/system.md): 要件定義から保守までの範囲と体制
- [Webアプリ開発](https://example.com/services/web.md): 対応フレームワークと開発の流れ
## 実績
- [導入事例一覧](https://example.com/cases.md): 業種別の開発事例
## Optional
- [会社概要](https://example.com/about.md)
- [採用情報](https://example.com/recruit.md)
日本語で書いても仕様上の問題はありません。仕様は作成時の指針として、簡潔で明確な言葉を使う、リンクには短い説明を付ける、説明のない専門用語を避ける、そしてllms.txtだけをエージェントに渡して質問し、答えられるか試すことを挙げています。最後の確認は、手元のChatGPTやClaudeにファイルの中身を貼り付けて「このサイトの料金体系は?」と聞けば、そのまま実行できます。
v2(2026年8月)で変わった4つの点
llmstxt.orgの変更履歴ページ(Changes)は、v2を「2026年8月」の改訂としています。国内の解説記事の多くはv1を前提にしているため、次の4点は読み替えが必要です。
サブパスに置いたllms.txtの適用範囲
v1もサブパスへの設置を認めていましたが、その意味は書かれていませんでした。v2は、llms.txtはそのパス以下のページを対象とし、複数が該当する場合はもっとも具体的な(深い)パスのファイルを使うと定めました。/docs/llms.txtは/docs/以下だけを説明します。GitHub Pagesのプロジェクトサイトのように、ドメインのルートを触れない運用でも参加できるようにするための変更です。
Markdown版とllms.txtをLinkヘッダーで知らせる方法
ページを開いたエージェントが、対応するMarkdown版やllms.txtの場所を推測せずに見つけられるよう、標準のリンク関係が推奨されました。rel="alternate" type="text/markdown"がそのページのMarkdown版、rel="describedby"がそのページを説明するllms.txtを指します。HTMLの<link>要素でも、HTTPレスポンスのLinkヘッダーでも指定できます。
Link: </docs/page.html.md>; rel="alternate"; type="text/markdown", </docs/llms.txt>; rel="describedby"
ヘッダー形式はWebサーバーやCDNの設定だけで追加できるので、CMSのテンプレートを改修できない場合でも導入できます。
Markdown版URLの2つの形式
v1はMarkdown版のURLをpage.html.md(元のURLに.mdを付ける)の1形式だけ定めていました。v2は、拡張子を置き換えるpage.mdも正式に認めています。ファイル名のないURLにはindex.html.mdまたはindex.mdを付けます。
llms_txt2ctxとOptional節の扱い
v1は、llms.txtとリンク先を1つのコンテキストファイルに展開するllms_txt2ctxというツールを紹介し、## Optional節には「短いコンテキストが必要なときは省略できる」という特別な意味を持たせていました。v2はこの展開ツールを仕様から外し、エージェントはllms.txtを見て必要なリンクをたどる、という使われ方を明記しました。これに伴いOptional節の機械的な意味もなくなり、二次的なリンクをまとめる慣習として残っています。
llms-full.txtとの違い
llms-full.txtは、サイトの全文や主要ページの本文をMarkdownで1ファイルにまとめたものです。llms.txtが目次とリンクだけを持つのに対し、llms-full.txtは本文そのものを含むため、1回の取得で内容を渡せる代わりに容量が大きくなります。
注意したいのは、llms-full.txtがllmstxt.orgの仕様には含まれていない点です。v1にもv2にもこのファイル名は出てきません。v1が例に挙げたのは、FastHTMLのドキュメントがllms_txt2ctxで生成していたllms-ctx.txt(Optionalを除く)とllms-ctx-full.txt(Optionalを含む)でした。llms-full.txtという名前は、ドキュメント基盤のMintlifyなどが自動生成するファイルとして広まったものです。
そのため「どちらが標準か」ではなく、仕様にあるのはllms.txtだけで、llms-full.txtは生成ツール側の慣習だと理解しておけば判断を誤りません。置くならllms.txtを先に整え、llms-full.txtは生成ツールが自動で作る範囲に任せます。全文を手作業で保守するのは現実的ではありません。
llms.txtの設置方法と動作確認
置き場所と配信形式
サイト全体を説明するならhttps://example.com/llms.txt、ドキュメント部分だけなら/docs/llms.txtのようにパス直下に置きます。静的ファイルとしてアップロードすればよく、特別なサーバー設定は要りません。仕様の配信元であるllmstxt.orgはcontent-type: text/plain; charset=utf-8で返しており、日本語を含む場合は文字コードがUTF-8で返っているかを確認します。
curl -sS -D - https://example.com/llms.txt
# ステータス200とcontent-typeを確認し、続く本文の1行目がH1(# サイト名)か、
# 意図したリンクが並び日本語が化けていないかまで目で確かめる
ヘッダーだけを取るcurl -Iでは本文を読まないため、中身が空のファイルやHTMLのエラーページが返っていても気づけません。本文まで取得して確認します。
ChromeのLighthouseには、エージェント向けの監査項目としてllms.txtのチェックがあります。ファイルの取得時にサーバーエラーが起きると指摘され、ファイルが存在せず404になる場合は「現時点では任意」として対象外(N/A)扱いです。置かないことで減点はされませんが、置いたファイルが500を返す状態は検出されます。
WordPressのllms.txt生成プラグイン
WordPressでは、主要なSEOプラグインが生成機能を持っています。Yoast SEOは2025年6月10日公開の25.3で、AIOSEOは2025年7月8日公開の4.8.4でllms.txtに対応し、llmstxt.orgの連携先一覧にも両方が載っています。
| プラグイン | 版(2026-09時点) | 有効インストール | 種別 |
|---|---|---|---|
| Yoast SEO | 28.5 | 1,000万以上 | SEO総合 |
| All in One SEO | 5.0.2 | 200万以上 | SEO総合 |
| Website LLMs.txt | 8.6.2 | 4万以上 | llms.txt専用 |
AIOSEOは無料版(Lite)でもllms.txtを自動生成できますが、llms-full.txtとMarkdown関連の設定はPro版の機能です。すでにYoast SEOかAIOSEOを使っているなら、同じ機能のために専用プラグインを追加する必要はありません。生成元は1つに絞り、公開後に/llms.txtを開いて意図したページが並んでいるかを確認します。
llms.txtの効果とGoogleの見解
「llms.txtは意味ない」と言われる最大の理由は、Googleの公式な説明にあります。Google検索セントラルの「Google’s Guide to Optimizing for Generative AI Features on Google Search」(2026年7月10日更新)は、生成AI検索について無視してよい施策の筆頭にllms.txtを挙げています。
You don’t need to create new machine readable files, AI text files, markup, or Markdown to appear in Google Search (including its generative AI capabilities), as Google Search itself doesn’t use them.
同じ箇所で、Googleは他のサービス向けにllms.txtを作って保守するのは「まったく問題ない」としたうえで、Google検索はそれを無視するため可視性や順位には良くも悪くも影響しないと書いています。AIによる概要(AI Overview)やAIモードでの引用を狙って置いても効果はありません。Google検索の生成AI機能で引用されるための条件はAI Overview対策とは?Google公式の条件と引用される記事構造・実装手順【2026年時点】、GEO全体の考え方はGEO(生成エンジン最適化)とは?SEOとの違い・E-E-A-Tとの関係で整理しています。
一方で、llms.txtを読む側は検索エンジンではなくエージェントです。AI事業者自身も開発者向けドキュメントにllms.txtを置いており、仕様v2はOpenAI(developers.openai.com/llms.txt)、Anthropic(docs.anthropic.com/llms.txt)、Geminiの公開例を挙げています。Cloudflare、Stripe、Vercelの開発者ドキュメントもllms.txtを公開しています。仕様が想定する用途は、エージェントがAPIの使い方などを調べるときに、読むべきページへ案内する入口です。
効果の有無は、読み手が誰かで分けて考えるのが正確です。Google検索での可視性や順位を上げる目的なら効果はなく、エージェントが自社の仕様を調べに来る状況を作りたいなら意味があります。
llms.txtを置くべきサイトと置かなくてよいサイト
置く価値がはっきりあるのは、APIリファレンス、SDK、開発者向けドキュメントを公開しているサイトです。利用者がClaude CodeやCodexのようなエージェントに「このライブラリで実装して」と頼むと、エージェントはドキュメントを取得しに来ます。llms.txtとMarkdown版を用意し、内容を最新に保っておけば、そのエージェントが参照するページを自社で指定できます。料金体系や利用規約が複雑なSaaSも、エージェントに正しい前提を渡す入口として使えます。
数十ページ規模のコーポレートサイトや、検索流入で成り立つメディアでは、置いてもGoogle検索の順位は変わりません。アクセスログで/llms.txtへの取得がどの程度あるかを見てから判断すれば十分で、それまではrobots.txtでAIクローラーへの方針を決めることと、本文の質を優先します。
避けたいのは、生成したまま更新しないllms.txtです。サービス内容や料金を変えたのにllms.txtが古いままだと、エージェントは古い要約を正しい情報として回答に使います。置くと決めたら、ページの追加・削除と同じ更新フローに組み込むか、CMSやドキュメント基盤の自動生成に任せてください。担当者が決まらないうちは、置かない方が安全です。
エージェントがサイトの内容を取得する手段はllms.txtだけではありません。サイト全体をMCPサーバーとして公開する方法はSiteMCPとは?サイト丸ごとMCPサーバー化するCLIの使い方と、アーカイブ後に使う前の注意点、知識を構造化して配布する新しい形式はOpen Knowledge Format(OKF)とは?Googleのv0.2仕様とRAGとの違いで扱っています。
よくある質問
llms.txtでAIの学習を拒否できますか?
できません。llms.txtの仕様にはアクセスを許可・拒否する構文がなく、AIに読んでほしいページを案内するためのファイルです。GPTBotやClaudeBotの収集を止めたい場合は、robots.txtでUser-agentを指定してDisallowを書きます。Googleの場合は、クローラーを止めるのではなくGoogle-ExtendedというトークンをDisallowにして、収集済みの内容をGeminiの学習などに使わせない設定にします。
llms.txtはSEOに効果がありますか?
Google検索への効果はありません。Googleは2026年7月10日更新の公式ガイドで、Google検索はllms.txtを使っておらず、置いても可視性や順位は上がりも下がりもしないと明記しています。効果が見込めるのは、コーディングエージェントなどがサイトの内容を調べに来る場面です。
llms.txtとllms-full.txtはどちらを置けばよいですか?
仕様にあるのはllms.txtだけなので、まずllms.txtを置きます。llms-full.txtは全文を1ファイルにまとめたもので、MintlifyやAIOSEOなどの生成ツールが作る慣習的なファイルです。ツールが自動生成してくれる場合に併せて公開する程度で十分です。
llms.txtはサイトのルート以外に置いてもよいですか?
置けます。2026年8月のv2で、llms.txtはそのパス以下のページを対象とし、複数ある場合はもっとも深いパスのものを使うと定められました。/docs/llms.txtならドキュメント部分だけを説明するファイルになります。
llms.txtは日本語で書いてもよいですか?
問題ありません。仕様が定めているのはH1・引用ブロック・H2のリンク一覧という構造で、言語の指定はありません。配信時の文字コードがUTF-8になっているかだけ確認し、文字化けしないことをcurlなどで確かめてください。