Primafonte 背后是谁
Primafonte 是一款免费工具,由 Obsidiaan Tech S.L. 开发并维护。这是一家西班牙公司,专注于把人工智能、区块链和颠覆性技术应用到真实项目中。
创意源自 Antonio Maroto。
一个不收费的扫描器,靠谁养活?
分析是免费而且完整的:33 项计分检查全给,无需注册,也不用留邮箱。养活它的是实施服务的收入——那些希望由我们来做这项工作的客户所委托的服务。没有人靠付费出现在结果里,没有人靠付费提高分数,分析数据也不出售。结果按域名保存 24 小时,只是为了不重复劳动而已,到点就自动删除。
为什么把整套方法论都公开?
一个既做诊断又卖解决方案的工具,存在明显的利益冲突,而唯一诚实的化解办法,就是让任何人都能核对每一分是怎么算出来的。所以 33 项检查全都写明了阈值、权重和理由,分布在四个层面上,权重分别是 25、30、30 和 15。方法论有版本记录,而此前的分数从不重算。
分数是怎么分配的?
这个指数把 100 分分配到四个层面,而且并非平均:让模型根本读不到你的问题,比只影响它如何描述你的问题分量更重。每一层都汇集了若干项检查,各自都有已公开的阈值;一个网站在某一层游刃有余、在另一层不通过,这并不矛盾。
- 可发现性,25 分:爬虫能否找到你,以及是否清楚可以拿你的内容做什么。
- 内容可访问性,30 分:机器人看到的东西,是否和人看到的相像。
- 语义结构,30 分:你的内容能否被切分、被引用而不失原意。
- 实体权威度,15 分:各模型能否把你识别为一个具体而稳定的实体。
这些阈值是根据什么数据定的?
阈值不是拍脑袋定的:它们是对着我们自己的一批样本校准出来的,321 个域名,来自西班牙、英国、美国和欧洲其他地区。其中 226 个能够完整测完,51 个的防火墙中断了分析,还有 41 个从未响应。这批样本的平均分是 61 分(满分 100),完整的研究连同方法都已经公开。
我们不做什么
有些决定与价钱无关,也与客户是谁无关,最好在别人开口之前就说清楚。下面这四条是被问得最多的,而答案从扫描器公开的第一天起就没有变过。每个域名的历史记录保存 24 个月,到期自动删除,不需要任何人来提要求。
- 我们不卖位置:没有人能靠付费出现在结果里,也没有人能靠付费改动自己的分数。
- 我们不公布别人网站的排行榜。谁来求诊,我们就为谁诊断;公布一份不及格名单则是另一回事。
- 我们不承诺某个具体的模型一定会引用你。没有人能保证这件事,敢保证的是在卖别的东西。
- 我们不使用任何 Cookie,自己的和第三方的都没有,分析时也不索取任何个人数据。
这一切依据的是什么?
以下是引擎真正落实的依据,不是推荐读物。如果我们给出的哪个数字你觉得不对,这里写明了它出自哪里,你可以自己核对。这四份资料都是公开且免费的,读完整篇也不需要注册任何账号。
- GEO: Generative Engine Optimization
这项研究测量了引用来源、提供数据和加入引文的效果:在回答中的可见度最多可提高四成。它是这个领域里少数经过严格测量的东西,其中两项检查的权重就来自它。
- schema.org 词汇表
结构化数据据以校验的词汇表:有哪些类型,以及每个类型把哪些字段标为必填。
- RFC 9309,机器人排除协议
规定 robots.txt 如何解读的标准,包括「最长的匹配优先、打平时 Allow 优先」这条规则。爬虫相关的检查用的就是它。
- llms.txt 约定
面向智能体的 Markdown 索引文件提案。它是事实上的约定,而非定稿的规范,因此它在指数中的权重可能会变。