Anthropic 于 7 月 24 日推出 Claude Opus 5,进一步调整其模型产品线。按公司公布的价格,Opus 5 的 API 输入费用为每百万 token 5 美元,与上一代 Opus 4.8 持平,但只有 Claude Fable 5 的一半。
多项测试成绩高于 Fable 5
从 Anthropic 公布的数据看,Opus 5 在多数核心测试中领先 Fable 5,也超过部分竞争对手。
在面向智能体编程任务的 Frontier-Bench v0.1 中,Opus 5 得分为 43.3%,高于 Fable 5 的 33.7%,也高于 OpenAI GPT-5.6 Sol 的 34.4%。
在 ARC-AGI-3 这类新问题求解测试中,Opus 5 得分为 30.2%,而 GPT-5.6 Sol 为 7.8%。Anthropic 文中未给出 Fable 5 在这一项的成绩。
在知识工作评测 GDPval-AA v2 中,Opus 5 的 Elo 评分为 1861,Fable 5 为 1747,GPT-5.6 Sol 为 1736。
企业测试强调稳定性与自动化能力
除公开基准外,Anthropic 还引用了多家企业的内部测试结果,试图说明 Opus 5 在实际场景中的表现。
开发者平台 Lovable 表示,Opus 5 在其高难度智能体编程任务中的表现较 Opus 4.7 提升 22%,同时多次运行之间的波动更小。
自动化平台 Zapier 则称,Opus 5 在 AutomationBench 测试中完成了一整套客户流失预防流程,包括识别高风险账户、通知负责人以及生成运营摘要,最终达到 100% 通过率。
Anthropic 还援引 DNA 测序公司 Ultima Genomics 的说法,称该模型在长链条分析中更接近“谨慎的科学家”式工作方式,能够选择合适的统计检验并交叉验证结果。
不过,按文中说法,Fable 5 在法律和医疗两个方向上仍有微弱优势。
产品线定位出现新变化
Anthropic 目前将模型分为多个层级。Haiku 主打速度与低成本,Sonnet 处于中间档,Opus 面向更重的任务负载。更高一层是今年春季引入的 Mythos 系列,其中包括面向公众的 Claude Fable 5。
这意味着,虽然 Fable 5 被放在更高层级定位中,但新发布的 Opus 5 在多数与日常使用相关的测试里反而取得更高分数,而且价格更低。
文章还提到,Opus 5 的推出,可能缓解外界此前对 Fable 5 公开可用性不足的担忧。除 API 外,Opus 5 也已向订阅用户开放。
- 标准模式:每百万输入 token 5 美元
- 标准模式:每百万输出 token 25 美元
- Fast 模式价格翻倍,速度约为 2.5 倍











