llms.txt 是正式互联网标准吗?
目前不是。它是面向大模型推理时读取网站内容的社区提案,支持范围会随工具和服务变化。可以把它作为低成本的人工导航层,但不应向客户承诺某个 AI 一定读取、引用或按照文件内容行动。
AI DISCOVERY / 站点治理
按社区提案的 Markdown 结构整理站点简介与人工精选入口,生成可放在域名根目录的 /llms.txt。
PUBLISH CHECKLIST
先说清站点做什么H1 使用站点或文档集名称,下一段引用块只写一句核心用途,不复制首页整段营销文案。
按任务分章节Tools、Guides、API、Blog 等章节应放真正重要的入口;标题和描述要让读取方不打开页面也能判断用途。
把次要内容降级Optional 是提案中特殊的可选章节。登录页、法律页和低优先级归档不必抢占主要上下文,也不要列出整站所有 URL。
格式来源:llms.txt 社区提案。 发布后请直接访问 https://你的域名/llms.txt,确认返回 UTF-8 纯文本和 200 状态。
RELATED TOOLS
USE & REVIEW
目前不是。它是面向大模型推理时读取网站内容的社区提案,支持范围会随工具和服务变化。可以把它作为低成本的人工导航层,但不应向客户承诺某个 AI 一定读取、引用或按照文件内容行动。
提案结构以一个 H1 站点或文档名称开头,随后可写一段引用格式的简短摘要,再写可选说明。主要入口按 H2 分章节,每条使用 Markdown 链接,可在冒号后补一段简短描述。链接应精选,而不是把 Sitemap 全量复制进来。
Optional 是提案中特别约定的低优先级章节,用来放读取方在上下文不足时可以省略的链接。例如归档、背景资料或次要政策页可以放在这里,把最重要的工具、文档和任务入口留在前面的普通章节。
不能。它是公开导航文本,不是访问控制或内容许可执行机制。抓取偏好应结合 robots.txt 与适用的内容信号,法律许可要有清晰条款,私有页面必须依靠登录、授权和服务端权限,不能仅靠 llms.txt 隐藏。
robots.txt 面向爬虫抓取规则,Sitemap 提供较完整的规范 URL 清单,llms.txt 则尝试给支持方提供简短说明和人工精选链接。三者用途不同,互不替代;站点通常先保证正常 HTML、内链、robots 与 Sitemap,再把 llms.txt 当作补充。
没有这种保证。它可能帮助支持该提案的读取方更快找到重要入口,但传统搜索收录仍看可抓取性、内容质量、站点信誉和内部链接,AI 引用也由各产品自行决定。发布后应检查文件可访问、内容准确,并随着页面结构变化人工更新。