摘要:两旗舰同价($10/$50 每百万 token),Fable 5.1 独立智能指数领先、缓存价低 4 倍;Astra 强在计算机使用与每任务成本。
九月初 OpenAI 和 Anthropic 两天内先后扔出旗舰,GPT-6 Astra(9/3)和 Claude Fable 5.1(9/1)定价还出奇一致:API 都是每百万输入 10 美元、输出 50 美元。于是"到底选谁"成了开发者论坛最热的话题。
先把结论摆出来:没有总冠军,只有场景冠军。独立评测机构 Artificial Analysis 给 Fable 5.1 的智能指数(最大 effort)打了 66,Astra 是 61;编码 Agent 指数 Fable 70 对 Astra 67。但 Astra 在 FrontierMath Tier 4 上 OpenAI 自家报了 98%、ARC-AGI-3 报 99.9%、ExploitBench 100%——这些硬推理和网络安全分数确实漂亮(不过 ARC 那个 99.9% 依赖 OpenAI 自家的 Provider Adapter,ARC Prize 用标准 harness 只测到 62.7%,得打个折)。

真正的分水岭在三个地方。一是缓存价:Astra 缓存输入每百万 1 美元,Fable 5.1 只要 0.25 美元,4 倍差距,长上下文、反复 prompt 的 Agent 会话里会滚成实打实的成本差。二是可用性:Fable 5.1 发布当天全云上线,Astra 先限量;企业管理员默认关掉 Astra,Plus 用户也只能在特定入口用。三是强项分工:Astra 的计算机使用(robot-control 成功率约 95%)、浏览器自动化明显更强;Fable 5.1 在长上下文知识工作、深度推理上更稳。
我的建议:做编码 Agent、长程知识工作的,闭眼 Fable 5.1;做数学、科学、桌面/浏览器自动化的,看 Astra。但别被"换模型"的冲动带着走——多数团队手里现有订阅的潜能还没榨干,先把指令、上下文和工作流设计做好,收益可能比换旗舰大。




