SEO 百科
llms.txt
本页目录
llms.txt 是一份放在网站上的纯文本文件,用来告诉 AI 模型在抓取时应该优先看哪些页面[1]。
这是社区提出的约定,而不是搜索引擎强制的标准[1]。
与 robots.txt 的区别
robots.txt 告诉爬虫哪些内容可以访问,用的是允许与禁止这类指令[1]。
llms.txt 建议 AI 模型优先看哪些页面,不控制访问,只提供挑选过的清单[1]。也就是说,前者管能不能来,后者管来了先看什么。
llms.txt 本身是一份 Markdown 文件,放在网站根目录,标题、摘要和分节的链接清单依次排开。以一家数控机床厂商为例:
# 数控机床厂商官网
> 本站提供数控车床、数控铣床的产品参数、选型指南与维护文档。
## 产品
- [数控车床](https://example.com/products/cnc-lathe.md):行程、主轴转速与加工精度
- [数控铣床](https://example.com/products/cnc-milling.md):三轴到五轴的加工范围
## 文档
- [选型指南](https://example.com/guides/selection.md):按材料与批量选择机型
## Optional
- [公司简介](https://example.com/about.md):生产基地与服务网点
模型先读标题和摘要,再顺着分节的链接去取具体页面。
现行的采用状况
截至目前,还没有主流 AI 平台确认自己在使用这份文件,也没有证据表明主流模型在抓取时会读它[1][2]。
Google 搜索中心已明确表示,llms.txt 文件对其 AI 搜索界面并非必要[1][3]。也就是说,这份文件的作用目前仍停留在可能性上。
与 AI 爬虫管理的关系
真正决定内容能否被取用的,仍是 robots.txt 那一层的设置[1]。
llms.txt 想解决的是发现与理解,而不是许可[1]。两层配合,才谈得上既被理解、又守住边界。
存在的意义
业内普遍预期 AI 流量会继续增长,因此一些站长愿意提前准备[1]。
robots.txt 当年也是可选项,后来才成为管理爬虫的必备[1]。也就是说,llms.txt 更像提前占位。
附录
参见
参考资料
第三方
- 《Does Your Website Need an LLMs.txt File?》,Backlinko。
- 《97% Of llms.txt Files Got No Requests, Ahrefs Data Shows》,Search Engine Journal。
- 《Google Confirms LLMs.txt Has No Current Implementation》,Search Engine Journal。
外部链接
无。