7月25日凌晨,Anthropic没有发布会、没有预告,直接上架了Claude Opus 5。
它没有讲宏大叙事,卖点相当务实:性能逼近Fable 5,价格只有后者的一半。网友的评论一针见血:“如果跟Fable 5差不多,那为什么还要花2倍的价格用Fable 5?”
价格:砍半,没商量
Opus 5的定价与Opus 4.8完全一致:输入每百万Token 5美元,输出每百万Token 25美元。Fable 5则是10美元和50美元。
刚好一半。不是“便宜一点”,是腰斩。
同步开放的Fast模式,用2倍价格换2.5倍速度。此外还有两个Beta功能:对话中途更换工具不失效、API触发安全分类器后自动降级而非直接报错。
性能:不止逼近,部分已超越
官方说法是“接近Fable 5的前沿能力”。实际跑分比“接近”更激进:
Frontier-Bench v0.1:Opus 5超越所有模型,性能是Opus 4.8的两倍以上,单任务成本更低
CursorBench 3.2:Max档Fable 5跑出70.5%,每任务17.32美元;Opus 5同档70.0%,每任务8.23美元——落后0.5个百分点,价格不到一半,Token用量少40%
ARC-AGI 3(解决全新未知问题):Opus 5得分是第二名的3倍
OSWorld 2.0(计算机操作):Opus 5用略高于三分之一的成本,超越Fable 5最好成绩
AA-Briefcase(智能体知识工作):Opus 5以1720 Elo领先Fable 5(1574)达146分
IMO 2026:不靠任何外部工具,拿下42/42满分
13项基准测试中,Opus 5在8项上超越Fable 5。
一个插曲:官宣图自己“翻车”了
发布后三小时内,传播最快的不是跑分,而是一个乌龙:官方对比表里,FrontierCode v1.1把Opus 5的53.4%加粗标成最优——旁边明明写着53.5%。
眼尖的开发者第一时间截图传开。讽刺的是,Anthropic给Opus 5定的核心卖点恰恰是“会自己核对工作”。不过玩笑归玩笑,Opus 5和Fable 5的差距已经小到连制图的人都会搞错谁赢了——而它的价签只有前者的一半。
市场定位:自己拆自己的台
Opus 5已全量上线,成为Claude Max新默认模型,也是Pro用户能摸到的最强模型。
问题是:如果Opus 5已经这么强,Fable 5卖给谁?答案藏在安全章节里。Opus 5“没有推进高风险两用能力的前沿”——生物研究和攻击性网络任务,它明确落后于Mythos 5。Fable 5和Mythos 5仍保留给需要顶尖安全与网络能力的客户。Opus 5则是把智能拿出来打折,把危险单独上了锁。
Anthropic延续了上一代的策略:刻意没在网络攻击类任务上训练Opus 5。安全分类器触发次数预计比Fable 5减少约85%。
Effort机制:丰俭由人
Opus 5引入了可调节的“思考程度”(Effort)设置。要强推理就调高,要省钱就调低。官方公布的大部分成绩都是在不同Effort设置下测出来的。花一半的钱,完成接近99%的工作。真正把“性能-成本”的选择权交到了用户手里。
行业信号:性价比逻辑正在改写竞争规则
Anthropic两个月内连发四款模型。Opus 5的定价策略标志着AI行业从“追求最强模型”转向“追求性价比”的竞争逻辑转变。
把旗舰性能打成了“日用品”——这句话或许是对Opus 5最准确的概括。它不是来取代Fable 5的,而是让更多人用得起接近Fable 5的能力。


