从阅读你到给你打分
「从阅读你到给你打分」指的是这样一种转变:网页不再被一个撰写文本的模型当作散文来阅读,而是被一个作出决定的模型用一个带类型的问题来评估。
七天之内关于 Jev(第一个通用决策模型)的文章超过五十篇,而它们全都把它当成你使用的工具。本页走相反的方向:它对你所发布的页面意味着什么。
究竟什么变了?
变的是谁在问,以及问的是什么。撰写型模型读你的页面,并可能在答案中引用它;决策模型拿到的是已经被提取好的文本,然后回答一个封闭问题——「这个页面是否涵盖此主题?」「从 1 到 5,程度如何?」——并给出概率和置信度。
结果不是一句关于你的话,而是一个被勾选的格子。没有人引用你,没有人链接你,也没有人看到你的名字:某个人得到一个关于你页面的数字并据此行动,而你毫不知情,因为该模型从未接触过你的服务器。
为什么是现在,而不是更早?
用机器评判页面一直都做得到,做不到的是付得起。Jev 的输入每百万 token 收费 0.042 美元,输出则完全不计费。
Boring Tools Kit 发布的一次审计用数字说明了这点:在不到 3 分钟内对 1204 个页面作出 4816 次判断,花费不到 1 美元。折算下来每次判断约为万分之二美元,过去需要一个咨询项目才能做的事,变成了一条塞得进夜间定时任务的查询。
什么没有变?
人们以为会变的,几乎都没有变。这一点值得先说,因为误解已经在流传,而且要花钱:
- 你的 robots.txt 不起作用:决策模型没有爬虫,也从不出现在你的日志里。
- 没有可以放行或封锁的 user agent,也没有需要申请的机器人验证。
- 没有什么需要声明:不需要新文件,不需要标签,也不需要特定的标记。
- 它不引用你,所以不存在「出现在它的答案里」:它根本不撰写答案。
我们不会叫你去做什么?
这里没有人会向你兜售针对决策模型的优化手法,因为还没有任何一种被测量过。这个指数由背后有证据支撑的检查项构成,而在这个题目上,证据只有一周之久,且没有任何独立研究。
也没有人会教你如何去推动一个裁决。Jev 的文档承认,为引导模型而写的文本可以改变答案,而恰恰在这里,衡量一个网站与操纵一次判断分道扬镳:后者一直有效,直到有人去看,而那时它已不是你的网站,而是你的陷阱。
今天唯一诚实、且不需要任何产品的说法,是一句常识:决策模型处理的是爬虫从你页面中提取出来的文本,因此最终被评判的是那次提取的质量。
怎么判断这是否影响到你?
看看你的页面变成纯文本之后还剩下什么。让网站对撰写型模型可读的那些功课——脱离导航也能读懂、标题写成问句、论断附上数据和来源——同样决定了什么能进入打分型模型的输入字段。
这就是可衡量的部分,而可引用性指数已经用 33 项检查在衡量它。一个只有一周历史的类别不需要一套新方法论:它需要的是没有人去凭空发明一套。
这些内容的出处
于 2026 年 9 月 22 日、即发布一周之后,对照厂商文档核对过。凡属第三方来源,均已注明。
- TypeSafe AI — Concepts: State
输入由调用方提供,且只接受文本:因此模型从不接触你的服务器。
- TypeSafe AI — Models
单次判断成本的来源价格:输入每百万 token 0.042 美元,输出免费。
- TypeSafe AI — jev-1.13 known issues
承认为引导模型而写的文本可以改变答案。
- Boring Tools Kit — 2026 年一次 SEO 审计的成本
第三方:不到 3 分钟内对 1204 个页面作出 4816 次判断,花费不到 1 美元。
- Firecrawl — What is Jev?
爬虫把页面转成 markdown,被评判的正是那段文本。
关于从阅读你到给你打分的常见问题
我需要因为决策模型而改动我的网站吗?
- 并不需要专门为它们改动什么。它们不抓取,从不出现在你的日志里,也不要求任何文件或标签;真正重要的是,当爬虫把你的页面转成文本之后还剩下什么。
我能出现在决策模型的答案里吗?
- 决策模型不撰写答案,因此无处可出现。它在事先声明的选项中返回一个选择,并附上概率。
Primafonte 会衡量面向决策模型的可引用性吗?
- 该指数衡量一个网站是否可被读取、理解和引用,而同样的基础也决定了哪些文本会抵达打分型模型。目前没有针对它们的单独检查项,在缺少实测证据之前也不会有。