直接答案
llms.txt 是放在站点根目录、专为 AI 引擎写的"内容导览文件"(基础配置见本库前文)。但很多站点配完就不管,效果平平。进阶做法四步:内容分级导览、建立更新机制、与 sitemap 分工、验证抓取效果。把 llms.txt 当产品运营,而不是当配置文件交付。
第一步:内容分级
不要平铺全部链接。按"AI 最该读什么"分级:第一层,核心事实页(服务、价格、案例数据、FAQ);第二层,方法论内容(知识库);第三层,背景资料(关于我们)。每条链接带一句说明——AI 按说明决定读不读,没有说明的链接形同虚设。链接总数控制在 50-100 条以内,过长会稀释权重。
第二步:更新机制
llms.txt 最常见的失败是"内容改了,导览没改":新上线的重点页面不在 llms.txt 里,等于没通知 AI。把它纳入发布流程——新页面(尤其是定价、服务、核心数据页)上线时同步更新 llms.txt,并保持文件顶部的最后更新时间真实。
第三步:与 sitemap 分工
| 文件 | 读者 | 职责 |
|---|---|---|
| sitemap.xml | 搜索引擎爬虫 | 全量 URL 清单,发现优先 |
| llms.txt | AI 引擎与 Agent | 精选内容导览,理解优先 |
| robots.txt | 所有爬虫 | 准入规则 |
三者并存,各司其职:robots 管门禁,sitemap 管发现,llms.txt 管导览。
第四步:验证效果
配置不等于生效:用无痕浏览器直接访问 域名/llms.txt 确认 200 且内容正确;检查 HTTP 头无 no-store 类限制;有条件的话在 AI 引擎里问"某品牌的核心服务是什么",观察回答是否体现了 llms.txt 中的优先内容。每季度复查一次。
小结
llms.txt 的价值不在"有",而在"准与常新"。分级、更新、分工、验证四步走完,它才会从摆设变成 AI 理解你站点的地图。
常见问题快答
llms.txt 现在哪些引擎支持?
adoption 仍在演进,但配置成本几乎为零,且对 AI Agent 与爬虫的理解都有帮助,属于「无悔动作」。
llms.txt 有格式标准吗?
有社区共识的结构(Markdown 式、分级列表),参照 llmstxt.org 的规范写,保持简洁。
放在哪个路径?
站点根目录 /llms.txt,与 robots.txt 同级,确保匿名可访问。
最后更新于 2026-07-21。本文持续修订,重大更新会标注日期。
