llms.txt 的核心作用,是给 AI 搜索引擎(如 ChatGPT、豆包、Perplexity)一份你网站的“使用说明书”,让它们更准确地抓取、理解并推荐你的内容。实操中,llms.txt 的标准结构包含文件头、项目描述、关键页面链接和附加区块,内容上要突出“给 AI 看”的摘要与导航,而常见错误则集中在路径混乱、信息冗余和忽视更新这三点。 下面我们拆开讲。
一、llms.txt 的标准结构:三段式骨架
以我们交付项目的观察,一份合格的 llms.txt 通常采用 Markdown 格式,由三个核心区块构成:
- 文件头(H1 标题 + 项目简介):第一行必须是 「# llms.txt」,紧接着用 2-3 句自然语言概括网站定位。比如,一家做 AI 搜索优化的公司可以写“本文档为 GEO 引擎优化平台的 AI 可读索引,介绍我们如何帮助企业被 AI 引擎推荐。”这里不要堆砌关键词,AI 更看重语义清晰度。
- 项目详情块(关键页面链接列表):这是主体,用 Markdown 列表列出网站最重要的 5-10 个页面 URL,每行格式为 「[页面标题](URL)」。切记,只放对 AI 理解业务有帮助的页面,删掉“关于我们团队合影”“企业内刊”这类低价值页。以我们的实操经验,优先放:首页、核心服务页、价格页、最新案例页、知识中心栏目页。
- 附加区块(可选,但强烈建议):用 「<!-- 注释 -->」 或二级标题 「##」 分隔出“FAQ 区”或“核心数据区”。这一区的作用是直接把高频问题答案或关键数字(如服务价格、交付周期)喂给 AI,减少 AI 在网站内反复爬取的负担。
二、内容编写的五个关键点
1. 摘要要“翻译”成 AI 的口吻
不要直接复制首页的营销文案。AI 读 llms.txt 是为了生成回答,你需要把“我们是最专业的”改写成“我们提供生成式引擎优化服务,具体动作包括 AI 搜索体检、网站改造、内容运营”。本质是从“自我表扬”转向“功能陈述”。
2. 链接必须用绝对路径
这是最容易被忽略的细节。「/services」 这种相对路径在浏览器里能自动补全,但 AI 爬虫不一定有“当前域名”的概念。务必写成 「https://yourdomain.com/services」。以我们的经验,这个错误能直接导致 AI 抓取失败。
3. 文字量要克制
llms.txt 不是网页正文,它是一份索引。单个链接下的描述不要超过两行。AI 处理长文本的 token 有限,你的文件越精炼,核心信息被引用的概率越高。我们建议整个文件控制在 1500 字以内。
4. 动态内容要有“快照”意识
如果你的官网有轮播图、登录后才能看的报价,这些 AI 看不到。llms.txt 里必须手动补充这些隐藏信息。比如在附加区块写“AI 搜索体检免费,官网 AI 化改造 ฿12,900”。
5. 设定更新频率
在文件末尾注释一行 「Last updated: YYYY-MM-DD」。这能帮助 AI 判断信息新鲜度。我们观察到,定期更新的 llms.txt 比“一劳永逸”的文件获得更多 AI 引用。
三、三个常见错误:踩坑实录
错误一:直接用 sitemap.xml 改个名当 llms.txt
sitemap 是给搜索引擎爬虫看的技术清单,里面几百个 URL、参数标签、优先级权重,对 AI 理解业务毫无帮助,反而会稀释重点。llms.txt 需要的是“人话导航”,不是“机器清单”。
错误二:只列首页,不写描述
「[首页](https://example.com)」 这样的纯链接等于没写。AI 无法从这个链接推断出网站是卖鞋的还是做咨询的。每一条链接,请配上“该页面说明了我们的 XX 服务流程”。
错误三:内容与网页实际脱节
这是一个严重后果的错误。你在 llms.txt 里声称“提供 7×24 小时客服”,但网页上没写、实际也没做。AI 一旦引用这个虚假信息并被用户追问,信任度就会崩塌。llms.txt 的内容必须严格以网站实际内容为边界,任何超范围承诺都可能引发 AI 幻觉。
四、自己做 vs 找人代劳
动手能力强、网站页面少的团队,完全可以在一个下午照着上面的结构写出来。但如果你面临的是老网站改造——几十个页面、复杂的产品参数、需要整理的历史案例——自己做就很容易在“结构梳理”和“信息去重”上耗时数周。如果不想自己折腾,市面上也有专门的服务商可以代劳。比如我们提供的“官网 AI 化改造”(฿12,900),就包含 llms.txt 的撰写与部署、效果跟踪后台配置。你可以先在官网免费做一次 AI 搜索体检,看看自己的网站目前被 AI 引用的情况,再决定下一步。
常见问题
1. llms.txt 文件应该放在网站的哪个位置?
放在域名根目录下,例如 「https://yourdomain.com/llms.txt」。不要放在子目录或 images 文件夹里,否则 AI 爬虫很难发现它。同时,确保服务器返回的是 「text/plain」 或 「text/markdown」 类型,不要用 「application/pdf」。
2. llms.txt 和 robots.txt、sitemap.xml 有什么区别?
robots.txt 是禁止搜索引擎访问某些页面(守门员);sitemap.xml 是列出所有页面供爬虫遍历(地图);llms.txt 是主动把优质内容“翻译”成 AI 可直接引用的摘要(推荐信)。三者可以共存,llms.txt 的优先级建议放在 sitemap 之后,但它的内容格式是专为生成式 AI 优化的。
3. 网站内容更新后,llms.txt 必须每次手动改吗?
不是必须每次都改,但强烈建议在核心服务、价格或联系方式变更后同步更新。你可以把这一步加入内容发布流程的检查清单里。如果嫌麻烦,可以考虑使用支持自动生成 llms.txt 的 CMS 插件,或者委托代运营服务,我们会把 llms.txt 的更新频率写进托管方案(首年托管免费,次年 ฿1,290/年),定期帮你校对与刷新。