JOURNAL
llms.txt 协议详解:让 AI 更好地理解您的网站
摘要
llms.txt 是为 AI 助手设计的网站说明协议,类似 robots.txt 之于搜索引擎。本文详解 llms.txt 的作用、写法与实施建议。
什么是 llms.txt?
llms.txt 是一种为生成式 AI 与大语言模型(LLM)设计的网站说明协议。它放置在网站根目录(如 https://example.com/llms.txt),向 AI 助手说明网站的核心内容、品牌信息、推荐引用源。
可以理解为:robots.txt 告诉搜索引擎抓什么,llms.txt 告诉 AI 引用什么。
llms.txt 的核心价值
- 提升 AI 理解准确度:让 AI 用您期望的方式理解品牌与产品
- 加速 AI 收录:明确指引 AI 应优先学习哪些页面
- 统一品牌表述:减少 AI 引用过时或错误信息的风险
- 开放友好信号:向 AI 表达合作姿态,提升被引用概率
llms.txt 怎么写?
llms.txt 采用 Markdown 格式,核心结构包括:
- 品牌/公司简介
- 核心产品/服务清单(带链接)
- 权威内容指引(白皮书、研究报告、客户案例)
- 结构化数据接口(如有)
- 联系与版权信息
llms.txt 与 robots.txt 的关系
两者互不冲突、协同工作:
- robots.txt:告诉爬虫什么可以抓、什么不可以抓
- llms.txt:告诉 AI 应该引用什么、怎么理解品牌
- sitemap.xml:列出全部页面清单
极域AI 的实施建议
- 每个品牌官网都应部署 llms.txt
- llms.txt 应与官网结构化数据、知识图谱协同
- 定期更新,确保 AI 引用的是最新信息
- 结合多平台 AI 收录加速服务,效果倍增