llms.txt:给 AI 爬虫的「说明书」,你的网站还没挂
大多数网站主的认知还停在 2005 年:加个 robots.txt,告诉搜索引擎「这些页面别抓」,就以为优化做完了。
但 AI 时代多了一个新文件——llms.txt,它解决的是一个完全不同的问题:不是「能不能来」,而是「来了以后,你值不值得被引用」。
一、robots.txt 和 llms.txt,到底差在哪
两者放的位置一样(网站根目录),但作用完全相反:
- robots.txt:给爬虫看的「门禁」——允许抓什么、禁止抓什么。它是负向清单。
- llms.txt:给大语言模型看的「导览手册」——用纯文本、简洁地说明「这个网站是干什么的、核心内容在哪、哪些资料值得读」。它是正向清单。
一句话:robots.txt 是保安,llms.txt 是前台接待。AI 模型训练和检索时,如果同时读到你清晰的 llms.txt,就能更快、更准地理解你的业务,把你写进回答。
二、llms.txt 长什么样
llms.txt 是纯 Markdown 文本,核心是「标题 + 简短介绍 + 链接清单」。下面是一个最小可用样例:
- 开篇一句「# 公司名 / 网站名」,一句话说清业务
- 列出 3–8 个核心页面的链接,每个附一句说明
- 可选的「>」引用块放关键事实、联系方式
- 复杂站点再配一个
llms-full.txt放全量内容
重点:链接越少越聚焦越好。AI 要的不是你把整站塞进去,而是用 10 秒读懂的「内容地图」。
三、为什么它对 GEO 是「必选项」
我们的多模型实测里,同样的品牌信息,有无 llms.txt 会直接影响 AI 的引用完整度:
- 降低理解成本:AI 不用爬全站再猜「这是卖什么的」,直接读你写的定位句
- 引导引用口径:你希望 AI 用哪句话描述你、推荐你哪些页面,主动权在你手里
- 补足结构化信号:配合 FAQ、数据表、Schema,形成完整的「机器可读」体系
一个残酷的事实是:现在挂 llms.txt 的国内企业站不到 1%。你现在补上,就是提前半年进入 AI 的「可引用名单」。
四、5 分钟给自己网站补上
不需要懂技术,按三步走:
- 写一个纯文本文件,按上面的格式列好定位句 + 核心链接
- 保存为
llms.txt,放到网站根目录(和 robots.txt 同级) - 在 robots.txt 里确认没有 Disallow 掉它,然后等 AI 下次收录
链龙的诊断报告里已包含 llms.txt 体检项——我们会告诉你:有没有、写得对不对、AI 能不能读到。 想省事,直接下单一份「诊断 + 网站体检套餐」,把这件「基础件」一次补齐。