Anthropic发布Claude Fable 5.1,基准成绩明显提升
Coinpaper
38分钟前
Ai 焦点
Anthropic 推出 Claude Fable 5.1,新模型在科研与终端编码测试中较前代明显提升,并已接入 Claude API 及多家云平台。
有帮助
No.帮助

Anthropic 于 9 月 1 日推出 Claude Fable 5.1 和 Claude Mythos 5.1。这是该公司在 6 月发布 Fable 5 后,对相关模型线进行的首次更新,重点围绕科研、代码任务表现以及订阅接入方式调整展开。

关键测试成绩提升

Anthropic 这次重点展示了几项面向科研和代码任务的基准结果。Fable 5.1 在 Terminal-Bench-Science 0.1 中拿到 52.6%,明显高于 Fable 5 的 24.7%,也高于 Opus 5 的 29.0%。

Terminal-Bench 4.0 主要测试模型在命令行环境中连续写代码、运行和调试的能力。Fable 5.1 的成绩为 55.8%,高于 Fable 5 的 42.0%,也略高于 Opus 5 的 52.3%。

Mythos 5.1 在同一测试中达到 60.9%。Anthropic 称,这一差距与两者采用的安全过滤设置不同有关。

在人文学科与多学科推理测试 Humanity's Last Exam 中,Fable 5.1 在不调用外部工具时得分 60.9%,使用外部工具后升至 65.0%。这两项成绩也都高于 Opus 5。

价格仍高于 Opus 5

尽管新模型在官方公布的测试中全面反超 Opus 5,但价格并未下调。Fable 5.1 的输入价格为每百万 token 10 美元,输出价格为每百万 token 50 美元;Opus 5 对应价格分别为 5 美元和 25 美元。

这意味着,Fable 5.1 虽然性能更强,但使用成本仍是 Opus 5 的两倍。Anthropic 的说法是,Fable 5.1 在较低或中等推理强度下,也能达到或超过旧版 Fable 5 的表现,从而降低实际使用成本。

不过,从日常任务场景看,用户是否会因此放弃更便宜的 Opus 5,仍取决于具体工作负载和预算。

订阅权限继续分层

在接入方式上,Fable 5.1 已上线 Claude API,并可通过 Amazon Bedrock、Google Cloud 和 Microsoft Foundry 使用。

但它并未全面纳入所有 Claude 订阅档位。Pro 套餐以及标准版 Team、Enterprise 席位,使用 Fable 5.1 时仍需消耗按量计费额度,计费标准与 API 相同。

Max 套餐以及高级版 Team、Enterprise 席位,则可将 Fable 5.1 计入订阅权益,使用上限为每周额度的 50%。

至于 Mythos 5.1,当前仍只向通过审核的网络安全和生命科学专业人士开放,接入路径延续了 Anthropic 之前的验证机制。

打赏
$0
点赞
0
收藏
0
浏览量 11
HQYC提醒,请广大读者理性看待区块链,切实提高风险意识,警惕各类虚拟代币发行与炒作, 站内所有内容仅系市场信息或相关方观点,不构成任何形式投资建议。如发现站内内容含敏感信息,可点击“举报”,我们会及时处理。
提交
评论 0
最热
最新
还没有人评论哦~快抢沙发吧!
相关阅读
苹果新任CEO预告下周将有重大发布
苹果新任 CEO 约翰·特纳斯称下周将有重大发布,市场关注折叠屏 iPhone 与新版 Siri AI。
TechCrunch
·2026-09-02 03:58:11
13
Anthropic发布Fable 5.1,降低成本并放宽限制
Anthropic发布 Fable 5.1 和 Mythos 5.1,新版模型下调成本、减少误判限制,并推进高隐私本地部署服务。
TechCrunch
·2026-09-02 03:58:08
12
以太坊:比特币跌破7.7万美元后反弹,油价走高压制加密市场
美伊冲突推高油价与美债收益率,比特币一度跌破 7.7 万美元,现货 ETF 净流入未能扭转短线跌势。
Coinpaper
·2026-09-02 03:20:16
21
美伊交火推高油价,美股科技股承压
美伊冲突升级推高油价和美债收益率,科技股走弱,能源股受益。
Coinpaper
·2026-09-02 03:20:13
15
查看更多