Primafonte

智能体发现文件

智能体发现文件,是一个网站发布在固定地址上、用来告诉人工智能智能体「这是什么网站、可以拿它做什么」的那些文件——而其中只有一部分,背后有配得上「标准」二字的东西。

这是这个领域里最混乱的一角。好几份提案名字相近,至少有一款产品自称行业标准,而从外面根本看不出差别。以下是每一个究竟是什么。

哪些已经立住了?

两个,也只有两个,建立在已完成的规范之上。是 RFC 8615 让 `/.well-known/` 成为一个可以正当发布声明的位置,而下面的一切,要么遵循它,要么无视它。

  • `/.well-known/agent-card.json` —— 由 A2A 规范定义,如今归 Agentic AI Foundation。已立住。
  • `/.well-known/tdmrep.json` —— 由 W3C 一个社区组的最终报告定义,而该报告声明自己不是 W3C 标准。已完成,但权威性低于人们通常赋予它的程度。
  • `/llms.txt` —— 一项被提出的约定,没有任何引擎公开承诺会读取它。发布得很广,但未获批准。

哪些并非它们看上去的样子?

有一份 IETF 的 Internet-Draft 提出了 `/.well-known/ai.txt`,由个人署名。所有 Internet-Draft 都带着同一句警告,这里同样适用:「把 Internet-Draft 当作参考资料使用,或以『进行中的工作』以外的方式引用它,都是不恰当的」。

另外也有网站和厂商在发布自己的 `ai.txt` 或发现端点,并把它描述成通用标准或行业标准。自称标准并不是一道流程,而且至少在一个案例里,提案是和实现它的产品打包在一起的。

一个细节就能说明问题:任何 Internet-Draft 若无人续期,6 个月后即失效。这就是那份文件的保质期——而在某些地方,它被当作可以据以构建的规范来引用。

那么一个网站究竟该发布什么?

发布那些你能用一句话说清用途的。一份带有按代理逐条写明规则的 robots.txt,因为许可这件事是真实的。如果你对挖掘有立场,就发一份 tdmrep.json。只有在你确实运营着一个智能体时,才发 agent card。llms.txt 值得发,因为它只花一小时,还逼你做一次有用的梳理。

其余的先放着,等情况变了再说。一个发布在 well-known 地址、却没有任何引擎去读的文件并不中立:它是一项关于你网站的、没有任何依据支撑的主张,而这个领域里这类主张已经够多了。

这些依据是什么?

管辖该地址的标准、一份让你看清「草案长什么样」的草案,以及这一带最近的一份认真提案。对照着读,落差就看得见了。

  • RFC 8615,Well-Known Uniform Resource Identifiers

    保留 `/.well-known/` 的那份标准。它就是「经过推敲的声明」与「在域名根目录下随手发明的文件」之间的那条线。

  • 一份提出 ai.txt 的 IETF Internet-Draft

    日期为 2026 年 6 月 12 日,由个人署名。上文引用它,是因为每一份 Internet-Draft 都带着「不要把它当参考资料引用」的那句提醒。

  • Agentic Resource Discovery,谷歌

    这一带最近、也最有分量支撑的提案,2026 年公布,基于 `/.well-known/ai-catalog.json`。它新到它的采用状况还称不上既成事实。

  • llms.txt 约定

    这一切中很大一部分由它而起。它是事实上的约定,而非已批准的规范,这一点它自己也写明了。

关于智能体发现文件的常见问题

存在一个标准的 ai.txt 文件吗?

不存在。至少有三份彼此无关的提案在用这个名字或相近的名字,其中包括 IETF 上一份个人署名的草案,以及一家把自家产品描述成行业标准的厂商。它们背后都没有已批准的规范,所以发布一个是在下注,而不是在做合规。

我该把能找到的发现文件都发布一遍吗?

不该。一个放在 well-known 地址上的文件,是在对你的网站作出一项主张;而没人读的那一个,作出的是没有依据支撑的主张。只发布那些你能用一句话说清用途的,其余的先放着,等谁会尊重它们这件事有了变化再说。
智能体发现文件:哪些才是标准 — Primafonte