llms.txt という新しい慣習は、追う価値があるか
サイトのルートに置く Markdown で、引用してほしいページを列挙するもの。コストはほぼゼロ——ただしランキング要因ではありません。
今年、AI に引用される方法について何か読んだことがあれば、llms.txt を見かけたはずです。サイトのルートに置く Markdown ファイルで、言語モデルに読んでほしいページを列挙するものです。
作るのに20分もかかりません。効果があるかどうかは、また別の話です。
それが実際に何なのか
この慣習は意図的に極限まで簡素です。ルートに /llms.txt、ただの Markdown、スキーマもありません。
# あなたのサイト
> このサイトが何なのかを一文で。
## 主要ページ
- [ホーム](https://example.com/):何を扱っているか
- [運営者情報](https://example.com/about):誰が運営しているか
## 記事
- [ある記事](https://example.com/blog/some-post):何を論じているか
狙いは、何を取りに行くか決めるモデルに対して、ナビゲーションから推測させるのではなく、人が整えた地図を渡すことです。
そうではないもの
三つはっきりさせておきます。ほとんどの解説が飛ばすところです。
標準ではありません。 標準化団体が承認したものではなく、遵守を約束したベンダーもありません。多くのサイトが採用した一提案にすぎません。
強制力がありません。 robots.txt と同じく任意です。ただし robots.txt と違って、クローラーがそれを前提に作られてきた長い歴史があるわけでもありません。したがって「すでに読む実装がある」という当ては効きません。
基本の代わりにはなりません。 本文がクライアントサイドレンダリングなら、そこを指す llms.txt は何も変えません。クローラーが辿り着いても、見えるのは空の殻です。まずそちらを直してください。
それでもやる価値がある理由
理由は二つで、どちらも「順位が上がる」ではありません。
-
コストがほぼゼロで、生成もできます。 当サイトのものはルートハンドラで、ブログ一覧が使っているのと同じ記事リストを読んでいます。公開すれば勝手に更新されます。限界費用はゼロです。
-
紛れのない意図表明になります。 どのページが中身で、どれが雛形なのかをモデルが——あるいは人が——知りたいとき、推測させる代わりに一つのファイルで答えたことになります。
根拠はこれだけです。安くて、明快で、もしかすると役に立つ。
自分のものを確認する
確かめることは二つ、最初の一つで大抵の失敗は見つかります。
curl -s https://your-site.com/llms.txt
200 と中身のある Markdown が返るはずです。よくある失敗は、ファイルはあるのにリンクが一つもないケースです。当サイトの監査にもまさにこれを指摘するルールがあります。URL のない見出しの羅列は、モデルに「どこへ行けばいいか」を何も伝えません。
手で curl する代わりに、llms.txt ツール がファイルの有無と形式の妥当性をまとめて示し、サイトマップからドラフトを起こします。
次に、書いた URL が実際に開くか確かめてください。llms.txt 内のリンク切れは、ファイルを置かないより悪いです。自分で指し示しているのですから。
正直なまとめ
入れましょう。20分を使えば済みます。ただし、それ自体が流量を運んでくると期待しないでください。引用されるかどうかを実際に決めているのは、サーバーサイドレンダリングされた本文、クローラーを弾かない robots.txt、構造化データ、そしてそもそも引用する価値のある中身があるかです。
最後の一つが、ほとんどすべてを決めています。