llms.txtとは?生成AIクローラーに正しく読ませる書き方と設置方法

「自社サイトの情報が、AIチャットや生成AI検索にうまく反映されない」と感じたことはありませんか?ChatGPTやPerplexityなど生成AIを使った情報収集が広まる中、従来のSEO対策だけでは生成AIクローラーへの対応が不十分になりつつあります。その解決策として注目されているのがllms.txtです。robots.txtと名前は似ていますが、目的も役割もまったく異なります。この記事では、llms.txtとrobots.txtの違いと生成AI対策における必要性から解説し、基本構造や業種別のサンプルコード、WordPressと静的サイト別の具体的な設置手順まで紹介します。robots.txtやXMLサイトマップとの整合性を保ちながらAIO施策全体へ組み込む考え方も身につけられる内容なので、読み終えたらすぐに実装へ踏み出せます。

目次
llms.txtとは?生成AI時代に登場したサイト案内ファイル
llms.txtは、WebサイトのルートディレクトリにMarkdown形式で置く「AI向けサイト案内ファイル」です。2024年9月にfast.aiの共同創業者でありAnswer.AIのCEOでもあるJeremy Howard氏が提唱し、公式仕様はllmstxt.orgで公開されています。robots.txtのようなアクセス制御の強制力はなく、AIモデルへの参考情報として機能するものである点を最初に押さえておいてください。
なぜllms.txtが必要になったのか
通常のWebページはHTMLで構成されており、ナビゲーションメニュー・広告・JavaScriptなどが本文と混在しています。LLM(大規模言語モデル)がこうしたHTMLをそのまま解析しようとすると、本質的な情報以外のノイズが多く含まれるため、内容を正確に把握することが困難になります。
この問題を解決するために考案されたのがllms.txtです。Markdown形式でサイトの構造や重要ページへのリンクをシンプルに記述することで、AIが必要な情報だけを効率よく取得できるよう案内します。
llmstxt.orgが定める仕様の概要
公式仕様はllmstxt.orgで定められており、主なポイントは次のとおりです。
- 配置場所:サイトのルートディレクトリ(例:
https://example.com/llms.txt) - 記述形式:Markdown形式
- 推奨サイズ:10KB以下(仕様上の上限規定はなし)
- 役割:robots.txtの置き換えではなく、AIモデルを正規ドキュメントや構造化された情報へ誘導する参考ファイル
重要なのは、主要なLLMプロバイダーがllms.txtを公式の引用シグナルとして利用することを正式にコミットしていない点です。「設置すれば必ずAIに読まれる」と保証されるものではなく、あくまでAIへの参考情報として提供する仕組みです。この前提を理解したうえで、次のセクションから具体的な書き方と設置方法を確認していきましょう。
robots.txt・sitemap.xmlとの違い:3ファイルの役割を整理する
llms.txtを正しく活用するには、すでに運用しているrobots.txtやsitemap.xmlとの関係を把握しておく必要があります。3つのファイルは目的も形式も異なり、それぞれが異なる役割を担う補完的な存在です。
| ファイル | 主な目的 | 対象 | 強制力 | 記述形式 |
|---|---|---|---|---|
| robots.txt | クローラーへのアクセス許可・拒否 | 検索エンジン/AIクローラー全般 | あり(クローラーが準拠) | 独自構文(テキスト) |
| llms.txt | AIへの情報提供・サイト案内 | LLM(大規模言語モデル) | なし(任意参照) | Markdown |
| sitemap.xml | URLのインデックス化の案内 | 検索エンジン | なし(参考情報) | XML |
robots.txtとの目的・強制力・記述形式の違い
robots.txtはクローラーに対して「このページを読んでよい/読んではいけない」とアクセス制御を行うファイルです。主要なクローラーはrobots.txtの指示に準拠するため、実質的な強制力があります。
一方、llms.txtはアクセスを制御するのではなく、「このサイトの情報をAIに正確に理解してもらうための案内」を記述するファイルです。AIモデルがllms.txtを参照するかどうかは任意であり、robots.txtのような強制力はありません。記述形式もrobots.txtの独自構文とは異なり、人間が読みやすいMarkdown形式を採用しています。
llms.txtはrobots.txtの代替でも上位互換でもなく、あくまでも補完的なファイルです。なお、robots.txtでAIクローラーのアクセスをブロックしている場合、llms.txtを設置しても参照される機会がなくなります。この点については後のセクションで詳しく解説します。
sitemap.xmlとの役割分担
sitemap.xmlは「サイト内に存在するURLの一覧」を検索エンジンに伝えるファイルです。どのページをインデックスしてほしいかを通知する目的で使われますが、記述するのはURLのみで、コンテンツの内容や優先度の説明は含みません。
llms.txtはURLの羅列ではなく、「このサイトが何を提供しているか」「どのドキュメントが重要か」をAIが理解しやすい自然言語と構造化リンクで記述します。sitemap.xmlがURLの地図だとすれば、llms.txtはサイトの概要と重要ページを解説した案内書のようなイメージです。2つのファイルは対象(検索エンジン vs LLM)も情報の粒度も異なるため、どちらか一方で代替できるものではありません。
llms.txtの基本構造と書き方
Markdown記法の基礎:H1・引用ブロック・リンクリストの書き方
llms.txtはMarkdown形式で記述します。必須要素はH1見出し(# サイト名)のみで、残りはすべて任意です。基本的な要素は次の3種類です。
- H1見出し(
#):ファイル冒頭に1つだけ記載。サイト名を置く - 引用ブロック(
>):H1直下に配置し、サイト概要を1〜2文で説明する - リンクリスト(
[ページ名](URL): 説明):各ページへのリンクと一行の説明を並べる
記述時の注意点が2つあります。「高品質なサービスをご提供」のようなマーケティング文言は避け、AIが内容を正確に把握できる平易・簡潔な表現にしてください。また、日本語サイトでも社名やサービス名は英語表記を併記すると、英語圏のLLMにも正確に認識されやすくなります。
H2セクションで情報を優先度別に整理する方法
H2見出し(##)を使うと、関連ページをグループ化できます。AIはファイルを先頭から読み込むため、重要度の高い情報ほど上部に配置するのが基本です。セクションの順序は「サービス → 製品 → 事例 → ブログ」のように、ビジネス上の重要度に合わせて並べてください。
Optionalセクションの使い方と除外指定
H2見出しの末尾に Optional と付けると(例:## ブログ記事一覧 Optional)、そのセクションはAIがコンテキスト窓(一度に処理できるトークン数)の上限に達した際にスキップしてよいことを示します。優先度が低いアーカイブや補足ページをOptionalに分類しておくことで、重要な情報が確実に読み込まれやすくなります。
除外したいページへの対応はシンプルで、llms.txtに記載しないだけで十分です。ファイル内に「除外」を明示する専用構文は仕様に定められていません。
そのまま使えるサンプルコード(企業サイト・ブログ向け)
企業サービスサイト向け
# 株式会社〇〇 (Example Corp)
> BtoB向けクラウド会計ソフトを提供しています。中小企業の経理業務効率化を支援します。
## サービス
- [料金プラン](https://example.com/pricing): 月額料金と各プランの機能比較
- [導入事例](https://example.com/cases): 業種別の導入実績と効果
## サポート
- [ヘルプセンター](https://example.com/help): よくある質問と操作マニュアル
## 会社情報 Optional
- [会社概要](https://example.com/about): 設立年・所在地・事業内容
ブログ/オウンドメディア向け
# マーケティングラボ (Marketing Lab)
> 中小企業のデジタルマーケティング担当者向けに、SEO・SNS広告・コンテンツ戦略の実践情報を発信しています。
## 主要記事
- [SEO基礎ガイド](https://example.com/blog/seo-basics): 検索エンジン最適化の基本を解説
- [Google広告入門](https://example.com/blog/google-ads): キャンペーン設定から運用まで
## カテゴリ一覧 Optional
- [SNSマーケティング](https://example.com/category/sns): SNS運用に関する記事一覧
- [コンテンツSEO](https://example.com/category/content-seo): コンテンツ制作の記事一覧
どちらのサンプルも、概要文は事実を端的に述べ、各リンクの説明を一文以内に収めているのがポイントです。AIに「何のサイトか」「どのページが重要か」を過不足なく伝えることを最優先に記述してください。
llms-full.txtとの違いと使い分け
llms.txtとllms-full.txtの役割の違い
llms.txtが「目次・案内役」なら、llms-full.txtは「全文収録の完全版」です。llms.txtはサイトの概要と重要ページへのリンクを10KB以下の軽量ファイルにまとめたもの。一方、llms-full.txtは各ページのテキストを抽出・クリーンアップしたうえで、一つのMarkdownファイルに連結した拡張ファイルです。
AIには「コンテキストウィンドウ」と呼ばれるトークン(一度に処理できる文字数)の上限があります。llms.txtはこの制約を踏まえ「AIに確実に伝えたい情報」に絞って記述するため、情報を効率よく届けられます。llms-full.txtはサイト全体の詳細情報をまとめてAIに渡せる一方、ファイルサイズは大きくなります。どちらもllmstxt.orgの仕様で定義されており、用途に応じて使い分けます。
どちらを用意すべきか:サイト規模別の判断基準
サイト種別ごとの推奨構成は以下のとおりです。
| サイト種別 | 推奨構成 |
|---|---|
| マーケティングサイト・小規模ブログ | llms.txtのみ |
| 技術ドキュメントサイト・APIリファレンス | llms.txt+llms-full.txt |
| 大量記事を抱えるガイドライブラリ | llms.txt+llms-full.txt |
マーケティングサイトや小規模ブログはページ数が少なく、概要とリンクリストだけでサイト全体をカバーできるため、llms.txtのみで十分です。テキストコンテンツが豊富なドキュメントサイトやAPIリファレンスでは、ページ全文をあらかじめ整理して提供することで、AIがクロールする負荷を減らしながら理解精度が上がる可能性があります。
ただし、llms-full.txtは作成・維持にコストがかかるため、多くの企業はllms.txtのみを導入しているのが実情です。まずllms.txtの整備を優先し、コンテンツ量が多いサイトに限ってllms-full.txtの追加を検討するのが現実的な進め方です。
llms.txtの設置手順(WordPress・FTP・静的サイト対応)
llms.txtの設置場所はWebサイトのルートディレクトリ固定です。https://ドメイン名/llms.txtでアクセスできる階層で、robots.txtやsitemap.xmlと同じ場所に置きます。サーバーがこのファイルをMIMEタイプtext/plainで配信できることも、あわせて確認が必要です。
FTP・サーバー管理画面からアップロードする方法
FTPクライアントやサーバーのファイルマネージャーを使う場合、手順は次の通りです。
- テキストエディタでMarkdown形式のllms.txtを作成する
- FTPクライアントまたはサーバー管理画面のファイルマネージャーで、ドメインのルートディレクトリ(
index.htmlやindex.phpと同じ階層)にアップロードする - ブラウザで
https://ドメイン名/llms.txtに直接アクセスし、内容がそのまま表示されることを確認する
wp-contentやwp-adminなどのサブフォルダに置いても正しく機能しません。必ずサイトのトップ階層に配置してください。
WordPressプラグインを使った設置方法
WordPressサイトには、プラグイン「Website LLMs.txt」を利用する方法が手軽です。プラグインをインストールして有効化するだけで、管理画面からllms.txtの生成・編集ができるようになります。手動でアップロードする場合は、wp-config.phpが置かれているWordPressのルートディレクトリにファイルを配置してください。wp-contentフォルダの中ではなく、その一段上の階層が正しい設置場所です。
設置後の動作確認チェックリスト
設置後は以下の項目を順番に確認してください。
- 表示確認:ブラウザで
https://ドメイン名/llms.txtにアクセスし、Markdownがそのままテキストとして表示されるか - HTTPステータス:レスポンスが「200 OK」であるか
- MIMEタイプ:レスポンスヘッダーの
content-typeがtext/plainであるか - H1の記述:ファイル冒頭に
# サイト名形式のH1見出しが正しく書かれているか - リンクの有効性:記載した内部リンクがすべて実際にアクセスできるURLであるか
HTTPステータスとMIMEタイプは、ChromeやEdgeの開発者ツール(F12→「ネットワーク」タブ)でllms.txtのリクエストを選択すると確認できます。
【設置前に必ず確認】robots.txtのAIクローラー設定を見直す
llms.txtを設置しても、robots.txtでAIクローラーをブロックしていればファイルは読まれません。設置の前提として、クローラーがサイトに到達できる状態かを確認してください。
主要AIクローラーのUser-Agent一覧(GPTBot・ClaudeBot・PerplexityBotほか)
主要なAI企業は学習用クローラーと検索・推論用クローラーの2種類を運用しています。robots.txtで制御するには、それぞれのUser-Agentを正確に指定する必要があります。
| User-Agent | 運営企業 | 主な用途 |
|---|---|---|
| GPTBot | OpenAI | 基盤モデルの学習 |
| OAI-SearchBot | OpenAI | 検索・推論時の参照 |
| ClaudeBot | Anthropic | 学習・推論 |
| PerplexityBot | Perplexity | 検索・回答生成 |
| Google-Extended | Geminiへの利用可否制御 | |
| Applebot-Extended | Apple | Apple Intelligence向け |
Google-Extendedは特殊で、実際のHTTPリクエストとしてサーバーログには出現しません。Googleがクロール済みのコンテンツをGeminiで利用するかを制御するトークンとして機能するものです。
AIクローラーをブロックしているとllms.txtが無効になる仕組み
robots.txtにDisallow: /が設定されている場合、GPTBotやClaudeBotはドメイン全体へのアクセスを遮断されます。この状態ではllms.txtへのリクエスト自体が届かないため、ファイルを設置しても読まれません。
また、CloudflareのBot Fight ModeなどWAF(Web Application Firewall:不正アクセスを防ぐセキュリティ機能)を有効にしている場合、robots.txtで許可していてもネットワーク層でAIクローラーがブロックされる可能性があります。llms.txtが機能しない場合はWAF設定も確認してください。
llms.txtと連携させるためのrobots.txt設定の確認・修正方法
AIクローラーにllms.txtを読ませるには、robots.txtで該当のUser-Agentを明示的に許可します。
User-agent: GPTBot
Allow: /
User-agent: OAI-SearchBot
Allow: /
User-agent: ClaudeBot
Allow: /
User-agent: PerplexityBot
Allow: /
User-agent: *にDisallow: /が記述されている場合、AIクローラーもその対象に含まれます。個別のAllowルールを必ず上位の行に追加してください。学習には使わせたいが推論・検索用クローラーのみ通したい、といった細かい制御も、User-Agentを分けて指定することで対応できます。
設定後はサーバーのアクセスログでAIクローラーの訪問を確認します。GPTBotとClaudeBotは週1回程度、PerplexityBotは1日複数回のアクセスが記録されていれば、クロールが正常に機能しているサインです。
llms.txtの効果と主要AI各社の対応状況・正しい期待値
OpenAI・Anthropic・Perplexityの対応状況
対応が明確なのはAnthropicとPerplexityです。AnthropicはClaude Desktop・Claude.aiの両方でllms.txtのディレクティブをレトリーバルワークフロー(情報検索の処理フロー)で尊重することを確認しています。Perplexityもファイルを取得してページの優先順位付けに活用していることが公開されています。
OpenAIについては公式な確認がありません。llms.txtを公開したサイトでChatGPT・SearchGPTの引用パターンに相関変化が観察されているという報告はありますが、因果関係は未証明です。効果が確定したものとして扱わないよう注意してください。
Googleが否定的な立場をとる理由
Googleはllms.txtをランキング要因・AI Overviewsの参照先として使用していません。Google-ExtendedやGeminiでも動作の変化は確認されておらず、Googleが優先するシグナルは引き続きrobots.txt・サイトマップ・構造化データです。Googleの担当者はllms.txtについて否定的な見解を公言しており、かつてのキーワードメタタグと同様に「実際に使っているAIサービスはない」という趣旨の発言をしています。Google経由の流入を主目的とする場合、llms.txtへの過度な期待は禁物です。
「意味がない」と言われる背景と、それでも設置する価値がある理由
批判の根拠の大部分はGoogleの非対応です。検索シェアを踏まえれば合理的な指摘であり、llms.txt単体で検索流入が増えることはありません。
それでも設置が合理的な理由はコストの低さにあります。ファイルは軽量でサーバー負荷はほぼゼロ。AnthropicとPerplexityはすでに実際に参照しており、IDEエージェントやMCPサーバーを含むAI Webスタック全体でも継続的に取得されています。主要な回答エンジンが本格対応した際に「準備済みの状態」を作っておくコストは今が最も低く、費用対効果は十分に高いといえます。
ただし、AI検索での可視性はllms.txtだけでは決まりません。コンテンツ品質・構造化データ・引用されやすい情報設計・ウェブ全体でのブランド言及が組み合わさって初めて効果を発揮します。E-E-A-Tをはじめとする本質的なLLMO施策と組み合わせて位置づけることが、正しい期待値での活用につながります。
よくある質問(FAQ)
llms.txtはどのサイトでも設置する必要がありますか?
設置は任意であり、必須ではありません。ただし、生成AIが自社サイトの情報を正確に読み取り、回答に活用しやすくするための有効な手段です。特にコンテンツ量が多いサイトや、AIに正確に伝えたい情報がある場合は導入を検討する価値があります。
robots.txtがあればllms.txtは不要ですか?
robots.txtとllms.txtは目的が異なるため、どちらか一方で代替することはできません。robots.txtはクローラーのアクセス制御を目的とするのに対し、llms.txtは生成AIに対してサイトの内容や構造を分かりやすく伝えるためのファイルです。両方を適切に用意することが推奨されます。
llms.txtを設置すると、検索エンジンのSEO順位に影響しますか?
llms.txtはGoogleなどの検索エンジンのランキング要因には現時点では含まれておらず、直接的な順位への影響はありません。あくまで生成AIクローラー向けの案内ファイルであり、従来のSEO施策とは別の取り組みとして位置づけてください。
llms.txtに書く内容に決まったフォーマットはありますか?
llms.txtはMarkdown形式で記述するのが標準的なフォーマットとして広まっています。サイトの概要、主要ページへのリンク、各コンテンツの簡単な説明を含めるのが基本構成です。ただし、2026年時点では公式な標準仕様として策定された規格ではないため、運用しながら内容を改善していく姿勢が重要です。
llms.txtを設置すれば、生成AIが必ず自社の情報を正確に回答してくれますか?
llms.txtを設置しても、生成AIが必ず自社情報を参照・引用することを保証するものではありません。生成AIがどのソースを参照するかは各AIの仕様に依存しており、llms.txtはあくまで「正確に読み取ってもらうための補助」にとどまります。設置することで情報の伝達精度が上がる可能性はありますが、効果を過信せず継続的なコンテンツ品質の向上と合わせて取り組むことが大切です。
あわせて読みたい
- 【2025年最新】サイト内検索とは?ユーザー体験とCVRを劇的に高める仕組み
- 【2025年最新】Core Web Vitalsとは?ウェブサイト最適化とSEOへの影響を徹底解説
- 【2025年最新】モバイルフレンドリーとは?モバイル端末の現代に必須のウェブ最適化ガイド
- 【2025年最新】レスポンシブデザインとは?SEOとUXを兼ね備えたレスポンシブデザインの実践ガイド
まとめ
この記事で解説してきたllms.txtの要点を、最後に整理します。
llms.txtとは何か・何でないか
- 何か: 生成AIクローラーに向けてサイトの構造・重要コンテンツ・連絡先などをMarkdownで案内するテキストファイル
- 何でないか: クローラーの行動を強制するファイルではなく、あくまで「推奨」を伝える案内書
- 誰が設置すべきか: AI検索(LLMO/GEO)での可視性を高めたい、あらゆる規模のWebサイト運営者・SEO担当者
実装の4ステップおさらい
- robots.txtを確認する — GPTBotやClaudeBotなど主要AIクローラーをブロックしていないかチェックする
- llms.txtを作成する — H1でサイト概要、引用ブロックで詳細説明、H2セクションで優先順位付きのリンクリストを記述する
- ルートに設置する —
https://example.com/llms.txtでアクセスできる場所に配置する - 動作確認をする — ブラウザで直接URLにアクセスし、内容が正しく表示されることを確かめる
正しい期待値で先行導入する価値
現時点では、llms.txtを設置したことによる効果は十分に証明されていません。しかし、ファイルの作成・設置にかかるコストは低く、AnthropicやPerplexityがすでに参照を開始している事実もあります。他のAI回答エンジンが本格対応したときに「設置済み」の状態にしておくことは、コストに見合った先行投資といえます。
ただし、AI検索での引用・言及はllms.txtだけで決まるものではありません。コンテンツの品質、構造化データの整備、引用されやすい情報設計、そしてE-E-A-Tの強化が組み合わさって初めて効果を発揮します。llms.txtはLLMO/GEO最適化の「入口」として位置づけ、継続的なコンテンツ改善と並行して取り組むことが重要です。
次に取るべきアクションは1つ——まず自サイトのrobots.txtを開き、AIクローラーへの許可設定を確認してください。そこが整っていれば、llms.txtの作成・設置はすぐに始められます。

ポスト
シェア







