1 min read

llms.txt 示例与模板:该写什么内容(以及如何验证)

可直接复制粘贴的 llms.txt 模板,适用于产品站、文档站和博客;关键字段、会让文件失效的错误,以及一份验证清单。

llms.txtGEOAI CrawlersTechnical SEO
llms.txt 示例与模板:该写什么内容(以及如何验证)

llms.txt 是位于 /llms.txt 的机器可读目录:一份简短的 Markdown 摘要,说明你是谁,以及 AI 系统应优先阅读的少数几个页面。 它不授予抓取权限(那是 robots.txt 的职责),也不是排名信号;它是一个路由文件,让检索更便宜、更准确。在本站运行了一年多之后(参见我们的90 天回顾),以下是真正有价值的模板,以及能发现损坏文件的验证检查。

行之有效的结构

# Product Name
> One-paragraph summary: what it is, for whom, what it does, pricing model.

## Core pages
- [Pricing](https://example.com/pricing): plans, limits, what each tier includes
- [Product overview](https://example.com/product): features, platforms, integrations
- [FAQ](https://example.com/faq): billing, data, cancellation

## Docs
- [Getting started](https://docs.example.com/start): install, first call, auth
- [API reference](https://docs.example.com/api): endpoints and schemas

模板背后的三条规则:

  1. 引用块是核心所在。 当模型描述你时,这段文字最有可能被逐字引用。像写目录条目一样写它:产品、受众、功能、价格模式——一段话,不要口号。
  2. 五到十五条链接,而不是五十条。 这个文件要在检索步骤中争夺注意力;一堵链接墙会稀释它。选择能回答买家问题的页面,而不是你的站点地图。
  3. 每个 URL 都必须是绝对路径且可访问。 相对路径和 404 是让一个本来不错的文件变成无用负担的两种最常见方式。

按站点类型划分的变体

  • 产品站点: 概览、定价、对比/vs 页面、更新日志、FAQ。
  • 文档站点: 入门、认证、最常用的三组端点、迁移指南。
  • 博客/出版方: 四篇支柱文章、关于页面和数据报告——跳过单篇文章。

它做不到的事

它无法让被阻止的爬虫进入(robots.txt 优先),无法在内容单薄之处创造引用,也会被那些从不抓取它的系统忽略。它的价值在于精确性:更少的错误摘要,更少的“模型描述了我们的旧定价”事件。

验证清单

  • 在 https://<domain>/llms.txt 返回 200,内容类型为 text/plain 或 markdown(不是 404,不是 HTML)。
  • 第一行是 # Title;随后是 > 摘要块。
  • 所有链接均为绝对路径、HTTPS 且可解析(在 CI 中为每行脚本化一个 HEAD 请求)。
  • 摘要与目录列表中使用的规范描述一致——一份事实清单,处处一致(参见如何在 ChatGPT 中排名,杠杆 2)。
  • 小于约 2 KB。如果你需要更多,你需要的是更少的链接,而不是更大的文件。
  • 在定价或定位变化时更新;过时的 llms.txt 会教给模型你旧的事实。

FAQ

每个站点都需要一个吗? 任何希望被 AI 系统准确描述的站点都需要——用上面的模板只需五分钟。对于定价复杂或频繁更名的产品,它最为重要。

先做 llms.txt 还是 robots.txt? 先做 robots.txt:先访问,后路由。我们的 AI 爬虫指南 涵盖了访问规则及其背后的代理。

我应该列出竞争对手的对比页面吗? 不。llms.txt 将读者路由到你的规范事实。其他域名上关于你的对比页面属于你争取提及的工作,而不是你的路由文件。


用与你的 llms.txt 相同的规范描述来运营列表足迹,才能让事实深入人心:在 aat.ee 上提交你的产品,在网络中永久且 dofollow。

做了个新产品?

在 aat.ee 发布,让早期用户和 AI 都看见你

在已被收录的目录上获得永久 dofollow 链接
被 ChatGPT 等 AI 助手引用推荐
提交项目