llms.txt是一份放在网站根目录、给AI看的文本文件,总结你是谁、卖什么、关键页面在哪;它添加成本几乎为零,但截至目前没有主流AI引擎承诺会读取它。如果你读过关于GEO(Generative Engine Optimization,生成式引擎优化)的介绍,大概率见过llms.txt被吹成"让你进AI答案"的神奇文件——我们自己也给客户网站加这个文件,但想把它实际的作用讲清楚。
是什么
"llms.txt"是一项建议中的约定(2024年9月,由Answer.AI的Jeremy Howard提出):在网站根目录放一份Markdown格式的文本文件,把"你是谁、重要页面在哪"总结给语言模型看。配套的"llms-full.txt"可以放展开版本。可以把它想成一张给机器看的前台接待卡:名称、一句话定位、核心业务、关键页面、联系方式。
不是什么
这里要说清楚炒作没讲的部分:截至目前,没有一家主流AI引擎承诺会读取llms.txt。它不是排名信号。没有证据显示ChatGPT、Gemini或Perplexity在组织回答时会去查它。我们做引用测试时,引擎实际摘用的是你的HTML页面——标题、描述、可见的正文文字。一个只写在llms.txt里的事实,对AI检索来说等于不存在。
这也是为什么,在我们自己的24项判据体检框架里,llms.txt相关检查项被明确标记为仅供参考、不计分。没有这个文件,网站不算有缺陷;有一份写得完美的llms.txt、但首页读不出来,网站照样是隐形的。
我们为什么还是会加
原因有三条,都不算重:
- 几乎不花钱。 一份静态文本文件,用你已经掌握的事实写一次就好。
- 这项约定可能会被采纳。 如果某个引擎明年开始读它,已经准备好的网站会追溯受益——这就是"保险"的逻辑。
- 写它本身是个有用的训练。 强迫自己用大白话说清楚"你是什么、在哪服务、提供什么"、并带上真实数字,往往会暴露出你现在的网站其实也没把这些话说清楚。先把网站改好。
如果要加,只有一条规矩
llms.txt里的每一个数字,都必须同时出现在你网站的可见页面上。我们在体检里会明确核对这一点:如果你的llms.txt写着"500多名客户",但网站上没有一个页面这么说,你就把最有说服力的证据放进了机器还不读的那份文件里——还给未来它真的被读取的那天埋了个前后不一致的坑。这份文件该是网站的忠实索引,不是另一套平行说法。
底线
把llms.txt当成加一份"humans.txt"或者做好一个favicon那样对待:快、准、做一次就好。真正该花力气的地方是检索实际发生的地方——服务端渲染出来的页面、写成答案形状的描述、首屏就有的硬数字,以及一份真实积累的内容语料。如果供应商的GEO方案开场就讲llms.txt,该问的是剩下十分之九的方案里到底是什么。