llms.txt生成器:让AI引用你内容的站点地图
llms.txt告诉AI爬虫你的网站有什么。
💡 你将学到
llms.txt告诉AI爬虫你的网站有什么。
llms.txt 生成器 2026:让 AI 引用你内容的网站地图
llms.txt 是一个提议中的标准(由 Jeremy Howard 于 2025 年提出)——一个位于你网站根目录的 markdown 文件,告诉 AI 爬虫你的网站有什么内容,以及哪些页面最重要。它是 robots.txt 和 sitemap.xml 在 AI 时代的姊妹文件。Perplexity、ChatGPT Search 等 AI 工具正越来越多地参考它。
为什么它很重要
- AI 爬虫只需一次请求就能读取它,而不用爬取数百个页面
- 你可以控制哪些页面被“精选”(即你希望被引用的页面)
- 它提供了原始爬取无法获得的上下文(比如“这是一个优惠券网站”“这些是我们的顶级指南”)
- 早期证据表明,被引用的页面与 llms.txt 中列出的内容存在相关性
格式
# 示例公司
关于该网站及其覆盖内容的简短描述。
## 精选文章
- [如何降低 AI Token 成本](https://example.com/token-costs):一份带基准测试的实用指南
- [本地 LLM 搭建指南](https://example.com/local-llm):硬件和模型推荐
## 页面
- [首页](https://example.com)
- [关于我们](https://example.com/about)
## 站点信息
- 语言:英语、中文
- 主题:AI、教程
如何生成
选项 1——手写(最适合小型网站)。 一个文件,30 分钟搞定。只需列出你最好的 10-20 个页面,附上一行描述。
选项 2——llms.txt 生成器工具。 GitHub 上有多个开源生成器(搜索“llms.txt generator”):它们会爬取你的 sitemap.xml 并输出 markdown。
选项 3——Python 脚本。 读取 sitemap.xml,从页面中提取标题/描述,然后写入 markdown:
import xml.etree.ElementTree as ET
tree = ET.parse("sitemap.xml")
urls = [u.findtext("{http://www.sitemaps.org/schemas/sitemap/0.9}loc") for u in tree.getroot()]
# 将 urls 写入 llms.txt 格式
放置规则
- 文件必须位于 https://yoursite.com/llms.txt(根目录,不是 /llms.txt.txt)
- 保持简短——最多 50 条,精选内容
- 发布重要的新内容时及时更新
- 从页脚或 robots.txt 中链接到它
常见问题
llms.txt 是排名因素吗? 不是官方的,但它能改善检索,从而提升引用率。可以把它理解为让你的内容更容易被找到和总结。
llms.txt 和 sitemap.xml 有什么区别? sitemap 面向搜索引擎;llms.txt 是为 AI 工具精选的。两者都需要。
它会影响 SEO 吗? 不会——它只是一个补充。Google 会忽略它;AI 工具会使用它。
相关文章
❓ 常见问题
llms.txt 是排名因素吗?
不是官方的,但它能改善检索,从而提升引用率。可以把它理解为让你的内容更容易被找到和总结。
llms.txt 和 sitemap.xml 有什么区别?
sitemap 面向搜索引擎;llms.txt 是为 AI 工具精选的。两者都需要。
它会影响 SEO 吗?
不会——它只是一个补充。Google 会忽略它;AI 工具会使用它。
本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。
