Anthropic 于周二推出 Claude Opus 5.5,作为 Claude 5.5 系列首个模型。公司称,这款模型在多数任务上的表现已接近旗舰版 Fable 5.1,但调用成本更低,面向普通开发者的可用性更强。
价格低于前代与旗舰
按照 Anthropic 公布的定价,Opus 5.5 的输入价格为每百万 token 4 美元,输出价格为每百万 token 20 美元,较 Opus 5 默认价格分别从 5 美元和 25 美元下调。若与 Fable 5.1 相比,Opus 5.5 的整体价格约低 40%。
公司还下调了缓存读取费用。该项费用适用于重复使用已处理上下文的场景,常见于长时间的代理式编程任务。新价格降至每百万 token 0.20 美元,降幅约 60%。
多项基准测试追近 Fable
Anthropic 把代理式编程视为衡量模型进展的重要方向,即模型可自主执行多步任务,而不只是响应单次提示。在 Terminal-Bench 4.0 测试中,Opus 5.5 完成率为 66.4%,高于 Fable 5.1 的 55.8%,也高于 GPT-6 Astra 的 57.9%。
在 FrontierCode 测试中,Opus 5.5 得分为 54.4%,Fable 5.1 为 50.3%。在覆盖 44 个职业真实工作任务的 GDPval-AA v2.1 中,Opus 5.5 的 Elo 评分为 1846,高于 Fable 5.1 的 1735,也高于 Opus 5 的 1708。
不过,这款模型并非在所有项目上领先。AutomationBench 中,GPT-6 Astra 以 41.4% 略高于 Opus 5.5 的 40.0%。在 Terminal-Bench-Science 0.1 中,Astra 也以 64.6% 高于 Opus 5.5 的 58.7%。
延续 Fable 级别安全限制
这是 Anthropic 首次在 CEO Dario Amodei 本月呼吁行业放缓模型能力提升后推出新模型。Amodei 当时表示,AI 能力进步速度正在超过安全测试的跟进速度。
Anthropic 表示,由于 Opus 5.5 在网络安全和生物相关能力上已达到公司“ Mythos 级”模型的限制标准,因此其上线时沿用了与 Fable 5.1 相同的安全措施。多数网络安全相关任务会被自动转交给较旧的 Opus 4.8 处理,这一做法此前曾引发部分开发者和用户不满。
已在三大云平台上线
目前,Opus 5.5 已在 Anthropic 自有平台以及 Amazon Web Services、Google Cloud 和 Microsoft Azure 上线。Anthropic 还表示,Sonnet 5.5 和 Haiku 5.5 将在未来几周内推出,并延续本轮降价安排。








