
Anthropic 把智能拿出来打折,把危险单独上了锁。
作者|张勇毅
美国时间 7 月 24 日,Anthropic 正式发布 Claude Opus 5,全平台同步上线。

但发布前三个小时内,X 上传播最快的不是它的跑分,而是跑分表里的一个「AGI moment」导致的 AI 生图错误:官方对比表里,FrontierCode v1.1 那一行把 Opus 5 的 53.4% 加粗高亮成了最优——旁边一格明明写着 53.5%。眼尖的开发者第一时间截图传开。

官方对比表里被圈出来的一行:53.4% 被标成了最优,右边就是 53.5%|图片来源:Anthropic
乌龙传得快,还有一层原因:Anthropic 这次给新模型定的核心卖点,恰恰是「会自己核对工作」。
不过玩笑归玩笑,把视线挪回数字本身:Opus 5 和自家旗舰 Fable 5 的差距,已经小到连制图的人都会搞错谁赢了——而它的价签,只有前者的一半。
自己拆自己最贵产品的台,这不像失误,倒更像计划的一部分。
01
价格最重要
Opus 5 的定价和前代 Opus 4.8 一致:每百万 token 输入 5 美元、输出 25 美元。作为参照,Fable 5 是 10 美元和 50 美元。
成绩单没给对手留客气话的余地。按官方博客(7 月 24 日)的数据:软件工程基准 Frontier-Bench 上,它超过所有模型,成绩比 Opus 4.8 翻了一倍还多,单任务成本反而更低。解新题的 ARC-AGI 3 上,得分是第二名的三倍。模拟电脑操作的 OSWorld 2.0 上,它花大约三分之一的成本,超过了 Fable 5 的最好成绩。
和旗舰贴得近的不止 FrontierCode 那一行。Cursor 随后公布的 CursorBench 最新榜单上,Fable 5 开到 Max 档跑出 70.5%,每任务 17.32 美元;Opus 5 同档 70.0%,每任务 8.23 美元。落后半个百分点,价格不到一半,token 用量还少了 40%。

Cursor 公布的最新榜单,Max 档的差距是半个百分点,价差是 9 美元|图片来源:Cursor
低一档更能说明问题。Opus 5 的 Extra High 全面超过 Fable 5 同档,每任务还便宜 4 美元。不开到顶配的话,便宜的反而是更强的那个。
产品端的待遇也说明定位:Claude Max 订阅的默认模型换成了它,Pro 用户能摸到的最强模型也是它。想更快,还有 2.5 倍速的 Fast 模式,价格翻倍。
官方放出的效率曲线图,Opus 5 的卖点一半写在纵轴的分数上,一半写在横轴的成本上|图片来源:Anthropic
发布本身没什么悬念。7 月 9 日,一个叫「Honeycomb」的陌生代号在 Cursor 的模型列表里一闪而过,几小时后被撤下。当时社区认出它的关键线索,是它的回退链指向 Opus 4.8——一个能拿 4.8 兜底的模型,能力必然在 4.8 之上。
现在回头看,那条回退链不只是泄露的破绽,它就是这套产品逻辑的入口。
02
拆开卖
Opus 5 把 Fable 5 逼平了,那后者还卖给谁——答案藏在发布博客的安全章节里。
官方的说法是,Opus 5「没有推进高风险两用能力的前沿」:生物研究和攻击性网络任务,它都明确落后于 Mythos 5——那个只向少数机构开放的管制版旗舰。这不是没做到,是没打算做到——Anthropic 延续上一代的做法,刻意没在网络攻击类任务上训练它。
效果体现在一个叫 OSS-Fuzz 的内部测试里:找漏洞,Opus 5 的成绩已经接近 Mythos 5;但把漏洞写成可用的攻击代码,它被远远甩在后面。它看得见漏洞,却被刻意教得不会把漏洞变成武器。

OSS-Fuzz 测试:找漏洞(左)接近 Mythos 5,写利用(右)被刻意留在了后面|图片来源:Anthropic
模型本身「不危险」,护栏反而可以松。官方预计,Opus 5 安全分类器的拦截频率会比 Fable 5 低 85% 左右——对每天写代码的人来说,这意味着被误伤的概率少了一大截。
真正的变化在拦截之后。被分类器拦下的请求,不再收到一句冷冰冰的拒绝,而是自动回退给 Opus 4.8 接着干活。生物类请求在 Fable 5 上被拦的,现在改道给 Opus 5。API 上还同步开了「自动回退」测试版——请求永远落在一个可用的模型上。
安全不再是聊天框里一句「我帮不了你」,而是被做进了架构:训练时少教一点,运行时就能少拦一点,真拦下来也不是死路,是改道。
数据政策是另一条分界线。Fable 5 上线时带着 30 天数据保留要求、没有零保留选项,不少企业客户为此犹豫;Opus 5 延续 Opus 系的老规矩,普通接入不要求保留数据。
把这些放在一起看,Anthropic 产品线的分层逻辑已经变了。过去 Haiku、Sonnet、Opus 是按聪明程度排队;现在 Opus 5 和 Mythos 5 之间隔着的不是智商,是风险与合规。Anthropic 把智能拿出来打折,把危险单独上了锁。
当然,也可以把这理解成价格战话术。GPT-5.6 在 7 月初开始推送,Kimi K3 这样的国产模型在用开源权重压价。Anthropic 没有降单价,改讲「每美元能干成多少活」。两种解释并不冲突:一个讲给市场听,一个讲给监管和企业客户听。
03
卖判断力
另外一个细节是,发布博客里篇幅最大的部分,其实不是跑分,是 Anthropic 官方测试的行为案例。
最典型的一个:测试给了 Opus 5 一张机械零件图纸,要求用代码重建三维模型——但故意不给它「看图」的能力。它自己写了一条计算机视觉流水线,从原始像素里把几何结构抠出来,再完成建模。同样条件下,没有一个对手模型在五次尝试内做出来。

官方演示中 Opus 5 生成的风洞流体模拟,可视化产出是这一代明显补强的部分|图片来源:Anthropic
一位参与早期测试的工程师提到的细节,也被 Anthropic 放进了发布博客:他坚持推自己的设计方案,模型没有顺从,而是把反对意见收窄到一个具体的设计问题,再给出一个保留他想法优点的折中方案。
Cursor 联合创始人 Sualeh Asif 的总结可能更直白一点:接近 Fable 5 的智能,Opus 的速度和成本。

自动化行为审计里,Opus 5 的不良行为得分是历代最低|图片来源:Anthropic
配上内部行为审计「历代最低」的不良行为得分(2.3 分),Anthropic 想卖的东西已经很清楚:agent 时代,模型比拼的正在从「有多聪明」,挪向「敢不敢放手让它干」。
但到目前为止,以上大多数还是之前参与内测的厂商口径,跑分图画得再好看,都不及普通用户的真实体验,因此真实成色还是要等接下来几周,开发者用工作流投票。
何况那张图本身就是 AI 翻的车,已经先让全球网友帮着核对过一回了。
Fable 5 发布还不到两个月,位置已经被自家兄弟顶得有些尴尬。
但 Anthropic 大概很乐意接受这种尴尬局面的出现:当模型真的被放进工作流,「能被信任的那一个」,可能比「最强的那一个」更值钱。
本文为极客公园原创文章,转载请联系极客君微信 geekparkGO