llms.txt 対 sitemap.xml 対 robots.txt: 違いは何ですか?
これら 3 つのファイルは同じ場所 (ドメイン ルート) に存在し、すべて「マシンにサイトについて伝える」必要があるため、常に相互に混同されます。これらは交換可能ではありません。それぞれが異なる対象者や異なる仕事向けに設計されています。実際に比較してみるとこんな感じです。
1 行の要約
robots.txt, クローラーに、_クロールできるものとクロールできないもの_を伝えます。sitemap.xml, _どのような URL が存在する_かを検索エンジンに通知し、URL を検出してインデックスを作成できるようにします。llms.txt, LLM とエージェントに、コンテキスト付きの、厳選された読みやすいマップを提供します。
さまざまな動詞: restrict、enumerate、explain。それがすべての違いです。
robots.txt: ルールブック
robots.txt は、数十年にわたって Web 標準として使用されてきました。これは、行儀の良いクローラにアクセスを許可するパスを伝えるディレクティブのプレーンテキスト ファイルです。
User-agent: *
Disallow: /admin/
Allow: /
Sitemap: https://example.com/sitemap.xml
重要な事実:
- これは許可と除外に関するものであり、コンテンツの品質ではありません。
- これは勧告です。準拠したボットはこれを尊重します。悪意のある人はそれを無視します。
- 多くの場合、サイトマップを指します。
robots.txt は、コンテンツの_意味_については何も述べていません。アクセスのみを管理します。
sitemap.xml: URL のインデックス
sitemap.xml は、サイト上の URL の機械読み取り可能なリストで、通常は最終更新日や変更頻度などのメタデータが含まれます。
<url>
<loc>https://example.com/docs/quickstart</loc>
<lastmod>2026-06-01</lastmod>
</url>
重要な事実:
- その対象者は検索エンジンで、クロールとインデックス作成のためにページを検出し、優先順位を付けるためにこれを使用します。
- 完全性が重要です。理想的には、見つけたいすべてのページがリストされます。
- 説明も、キュレーションも、どのページが最も重要であるかについての感覚もありません。
サイトマップは「どのようなページが存在するのか?」という質問に答えます。 「このサイトは何についてのサイトですか?」という質問には答えられません。または「どこから始めればよいですか?」
llms.txt: モデルの読み取り可能なマップ
llms.txt は、大規模な言語モデルとそれを中心に構築されたツールを対象とした Markdown ファイルです。すべての URL をリストするのではなく、重要な URL を厳選し、セクションに編成して、それぞれを説明します。
# Example Docs
> A short summary of what this product does.
## Getting Started
- [Quickstart](https://example.com/quickstart): Set up in five minutes
- [Concepts](https://example.com/concepts): Core ideas you need first
重要な事実:
- 対象者は LLM、エージェント、RAG パイプライン、MCP/自動化ツール、および簡単な説明を必要とする人間です。
- これは理解とキュレーションに関するものであり、網羅的な列挙ではありません。
- これは Google のランキング要素ではありません。Google はそれを使用していないと述べています。 (詳細については、llms.txt は Google ランキング要素ですか? を参照してください。)## 並べて
| ロボット.txt | サイトマップ.xml | llms.txt | |
|---|---|---|---|
| 仕事 | クロールを制限する | URL を列挙する | コンテンツの説明と厳選 |
| 視聴者 | クローラー/ボット | 検索エンジン | LLM、エージェント、ツール |
| 形式 | ディレクティブ | XML | マークダウン |
| 厳選? | いいえ | いいえ | はい |
| 説明? | いいえ | いいえ | はい |
| Google のランキングに影響しますか? | 間接的に (アクセス) | 間接的に (発見) | いいえ |
相互に置き換えられますか?いいえ。
よくある間違いは、llms.txt を他の 2 つの最新の代替品として扱うことです。それはそうではありません:
- クローラー アクセスは制御されません。
robots.txtはそのままにしておきます。 - 検索エンジンがすべてのページを確実に検出できるわけではありません。
sitemap.xmlを維持してください。 - 他の 2 つは、モデルに厳選された説明された概要を提供しません**。これが
llms.txtの独自の仕事です。
それらは補完的なものです。適切に運営されているサイトには、3 つすべてがあり、それぞれが独自の処理を行うことができます。
どれが必要ですか?
- すべての人は、従来の検索のための賢明な
robots.txtおよびsitemap.xmlの恩恵を受けます。 llms.txtはオプションで、モデルやエージェントに正確に理解してもらいたいドキュメント、API、開発者製品、またはコンテンツがある場合に最も役立ちます。それがあなたではない場合は、スキップしても問題ありません。詳細については、llms.txt が意味をなすとき を参照してください。
結論
robots.txt は制限、sitemap.xml は列挙、llms.txt は説明します。彼らは 3 つの異なる視聴者向けに 3 つの異なる問題を解決しており、1 つを採用しても、もう 1 つを廃止することを意味するわけではありません。
あなたのサイトが llms.txt に適している場合は、llms.txt ジェネレーター でクリーンなドラフトを生成し、公開する前に 検証ツール でチェックしてください。