Primafonte

可引用性指数

可引用性指数是一个 0 到 100 的分数,用来衡量一个网站能否被生成式模型读懂、理解并引用。

它由 Primafonte 发布,依据 33 项技术检查计算,这些检查分属四个权重不同的层面;它有版本号,每一份报告都写明出自哪个版本。本页给出术语的定义,方法论页面则记录每一分是怎么给出来的。

可引用性指数衡量什么?

它衡量模型在把你列为来源之前需要的四件事:它的爬虫能够到达你;爬虫看到的内容与真人看到的内容相符;你的内容被切成片段之后依然成立;以及你能够被认作一个确定的实体,而不是又一个网站。

这四件事各自构成一个层面,各有权重,而权重并不相同。让模型根本读不到你的问题,比只是影响它如何描述你的问题分量更重。

一个分数意味着什么?

分数会落进四个区间之一,而区间比具体数字更重要。58 和 61 之间的差距是噪声;两个区间之间的差距,决定的是模型究竟能不能把你当作来源。

  • 0 到 39 — 不可引用:各模型无法把这个网站当作来源。
  • 40 到 59 — 部分可读:它们能找到你,但无法可靠地引用你。
  • 60 到 79 — 可引用但有缺口:能用,只是有几处明确的盲区。
  • 80 到 100 — 就绪:没有结构性障碍。

它和 SEO 分数有什么不同?

SEO 分数预测的是你会不会出现在一串链接里。可引用性指数预测的是模型能不能在一段写出来的回答里引用你,两者奖励的信号并不相同:一个页面可以在谷歌排第一,却依然不能当作来源,因为它的内容要等 JavaScript 跑完才存在。

两者共享地基,在看重什么上分道扬镳。域名权重能推动排名,对可引用性毫无帮助;而一个在清晰标题之下能独立成立的段落,作用恰好相反。

可引用性指数由谁发布,分数能买吗?

由 Primafonte 发布,Primafonte 则由 Obsidiaan Tech S.L. 维护。没有人靠付费出现在这里、被测量,或者改变自己的分数。分析免费,报告完整展示,不需要注册,也不需要留邮箱。

这项工作靠实施服务的收入支撑,也就是那些希望由我们动手修好网站的客户。这就是全部的商业模式。把它写在这里,是因为一项看不到资金来源的测量,就是一项你无法核实的测量。

可引用性指数会随时间变化吗?

方法带有版本号,每份报告都印着生成它的版本。随着证据积累,门槛会移动;一项说不清自己为什么对模型重要的检查会被撤下,而不是为了凑数留着。

旧的分数从不重算。一份报告描述的是某个网站在测量当天、按当天标准的状态,所以两份出自不同版本的报告之间的差异,是标准变了,而不是进步。

这个定义依据的是什么?

术语是我们提的,背后的标准不是。以下四份参考资料是引擎逐字实现的依据,全部公开,且无需注册即可完整阅读。

  • GEO: Generative Engine Optimization

    这项研究测量了标注来源、提供数据和加入原文引用的效果:在回答中的可见度最多提高 40%。其中两项内容检查的权重就来自它。

  • schema.org

    结构化数据据以校验的词汇表。本页也正是用它,把这个术语本身声明为一个有定义的实体,而不是一句说法。

  • RFC 9309,机器人排除协议

    这项标准厘清了 robots.txt 该怎么读,包括最长匹配优先、平局时 Allow 胜出。可发现性层面据此执行。

  • llms.txt 约定

    面向智能体提出的 Markdown 索引文件。它是事实上的约定,而非已定稿的规范,因此它在指数中的权重可能会变。

关于可引用性指数的常见问题

可引用性指数是官方标准吗?

不是。它是 Primafonte 发布的一套公开且带版本的方法论,而不是标准化机构颁布的规范。各项检查实现的是已发布的规范和一项有测量数据的研究,文档写明了是哪些、权重多少、门槛在哪,好让人能够就某一个具体数字提出异议,而不是笼统地反对整套方法。

我能不用 Primafonte,自己测量吗?

可以。每一项检查都写明了门槛和权重,方法论以知识共享署名许可发布。手工做一遍要花几个小时而不是几秒钟,但里面没有任何秘密,这是有意为之:一个谁都无法复现的分数,谁都不该相信。

可引用性指数高,就保证人工智能会引用我吗?

不保证,承诺相反结论的工具是在卖东西给你。这个指数衡量的是技术和结构上的障碍有没有被清除。模型之后会不会提到你,取决于你所在的品类、你的竞争对手,以及每个引擎多久重新索引一次。它是必要条件,不是充分条件。
可引用性指数:定义、层面与分数区间 — Primafonte