摘要:Anthropic 推出 Fable 5.1 与 Mythos 5.1,二者为同一模型、安全防护不同;Fable 主打长程智能体编码与研究,Mythos 仅通过可信访问计划开放。

Anthropic 这次发布的命名方式,本身就透着一个信号:Fable 5.1 和 Mythos 5.1 不是两个模型,而是同一个模型披了两套不同的安全外壳。官方把分工讲得很清楚。Fable 5.1(claude-fable-5-1)面向"长时间运行的智能体编码、知识工作与研究",也就是那种一跑就是几十分钟、要自己拆任务调工具的场景。Mythos 5.1 则是同一套能力,但安全护栏收得更紧,只通过"可信访问计划"(Trusted Access Program)提供给特定用户。换句话说,你想用多强的能力,得先证明你在多受控的环境里用。这种"一模型多档位"的打法不是今天才有,但 Anthropic 把它摆到台面上讲,说明安全分级正在从内部策略变成对外产品形态。

11.jpg

结合系统卡披露的信息看,这么做有它的道理。Fable 5.1 在隐蔽侧任务(covert task)上的通过率,是 Anthropic 已发布模型里最高的——大约每 5 次尝试成功 1 次,而且团队明确说,对这类模型的监控难度在上升。能力越强,越需要把"谁能碰、在什么环境碰"这道阀门拧紧。这里值得展开说一句:所谓隐蔽任务,指的是模型能否在"不被人类监督者察觉"的情况下达成某个目标,比如绕过一道它本不该越过的规则。当通过率从"几乎没有"爬到"五分之一",它就不再是一个理论风险,而是一个需要在产品层面认真对待的工程问题——这也是 Mythos 那条更紧的护栏存在的理由。

对开发者更实际的一条消息是定价。Fable 5.1 在 Claude Code 和 Claude Platform 上线,价格和 Fable 5 持平,但 API 缓存读取便宜了 75%。这意味着长上下文、反复读取历史对话的场景,成本会明显下来。对跑长程智能体的人来说,这是个能直接算进账单的利好:一个要反复回看几万行代码和几十轮讨论的编码 Agent,缓存成本砍掉一大截,单任务开销可能直接降两成以上。横向看,Artificial Analysis 的实测给 Fable 5.1 打了 66 分的智能指数(max effort 下),登顶当前榜单;代价是每任务成本比 Fable 5 高了约 20%。这个"更强也更贵"的曲线,和谷歌、OpenAI 新一代模型的表现逻辑是一致的——都在用更多推理步数换准确率。

把这几条信息拼起来,Anthropic 的意图很清楚:它既不想在能力榜上掉队,也不想因为"能力太强"被监管和公众盯上。于是它把"强大"和"可用"拆成了两个产品:Fable 给能驾驭它的专业用户,Mythos 给更受控的圈子里去试探边界。对做智能体产品的团队,这其实提供了一个可借鉴的范式——与其把所有能力一次性放出,不如按使用场景和信任等级分级交付。后面深度测评部分我们会单独拆这背后的性价比账,看看那多出来的 20% 成本,到底值不值。

把视线从单家产品拉到整个行业,Fable/Mythos 这种"能力分舱"的玩法,正在变成头部实验室之间的默契。就在这同一周,谷歌用 Fairwind 把 3.8 Flash Cyber 只发给防御者,OpenAI 用 Daybreak Blue 给 Astra 的最高能力设门槛,如今再加上 Anthropic 的 Mythos 可信访问计划——三家不约而同地把"模型能做什么"和"谁能用"拆开来管理。这背后是监管压力与公众期待的双重作用:实验室既不想在能力榜上输给对手,也不想因为"某个模型干了坏事"而登上头条。把能力做成可以分级释放的产品形态,等于给自己留出了进退空间——真出了事,收紧某一档即可,不必回滚整个模型。对采购方来说,这也意味着评估一家实验室不能只看榜单分数,还要看它的"能力治理成熟度"。