Primafonte

Primafonte 背后是谁

Primafonte 是一款免费工具,由 Obsidiaan Tech S.L. 开发并维护。这是一家西班牙公司,专注于把人工智能、区块链和颠覆性技术应用到真实项目中。

创意源自 Antonio Maroto。

一个不收费的扫描器,靠谁养活?

分析是免费而且完整的:33 项计分检查全给,无需注册,也不用留邮箱。养活它的是实施服务的收入——那些希望由我们来做这项工作的客户所委托的服务。没有人靠付费出现在结果里,没有人靠付费提高分数,分析数据也不出售。结果按域名保存 24 小时,只是为了不重复劳动而已,到点就自动删除。

为什么把整套方法论都公开?

一个既做诊断又卖解决方案的工具,存在明显的利益冲突,而唯一诚实的化解办法,就是让任何人都能核对每一分是怎么算出来的。所以 33 项检查全都写明了阈值、权重和理由,分布在四个层面上,权重分别是 25、30、30 和 15。方法论有版本记录,而此前的分数从不重算。

分数是怎么分配的?

这个指数把 100 分分配到四个层面,而且并非平均:让模型根本读不到你的问题,比只影响它如何描述你的问题分量更重。每一层都汇集了若干项检查,各自都有已公开的阈值;一个网站在某一层游刃有余、在另一层不通过,这并不矛盾。

  • 可发现性,25 分:爬虫能否找到你,以及是否清楚可以拿你的内容做什么。
  • 内容可访问性,30 分:机器人看到的东西,是否和人看到的相像。
  • 语义结构,30 分:你的内容能否被切分、被引用而不失原意。
  • 实体权威度,15 分:各模型能否把你识别为一个具体而稳定的实体。

这些阈值是根据什么数据定的?

阈值不是拍脑袋定的:它们是对着我们自己的一批样本校准出来的,321 个域名,来自西班牙、英国、美国和欧洲其他地区。其中 226 个能够完整测完,51 个的防火墙中断了分析,还有 41 个从未响应。这批样本的平均分是 61 分(满分 100),完整的研究连同方法都已经公开。

我们不做什么

有些决定与价钱无关,也与客户是谁无关,最好在别人开口之前就说清楚。下面这四条是被问得最多的,而答案从扫描器公开的第一天起就没有变过。每个域名的历史记录保存 24 个月,到期自动删除,不需要任何人来提要求。

  • 我们不卖位置:没有人能靠付费出现在结果里,也没有人能靠付费改动自己的分数。
  • 我们不公布别人网站的排行榜。谁来求诊,我们就为谁诊断;公布一份不及格名单则是另一回事。
  • 我们不承诺某个具体的模型一定会引用你。没有人能保证这件事,敢保证的是在卖别的东西。
  • 我们不使用任何 Cookie,自己的和第三方的都没有,分析时也不索取任何个人数据。

这一切依据的是什么?

以下是引擎真正落实的依据,不是推荐读物。如果我们给出的哪个数字你觉得不对,这里写明了它出自哪里,你可以自己核对。这四份资料都是公开且免费的,读完整篇也不需要注册任何账号。

  • GEO: Generative Engine Optimization

    这项研究测量了引用来源、提供数据和加入引文的效果:在回答中的可见度最多可提高四成。它是这个领域里少数经过严格测量的东西,其中两项检查的权重就来自它。

  • schema.org 词汇表

    结构化数据据以校验的词汇表:有哪些类型,以及每个类型把哪些字段标为必填。

  • RFC 9309,机器人排除协议

    规定 robots.txt 如何解读的标准,包括「最长的匹配优先、打平时 Allow 优先」这条规则。爬虫相关的检查用的就是它。

  • llms.txt 约定

    面向智能体的 Markdown 索引文件提案。它是事实上的约定,而非定稿的规范,因此它在指数中的权重可能会变。

Primafonte 背后是谁