利好

Claude Fable 5.1 基准得分翻倍,定价为 Opus 5 两倍

03:36

Anthropic 发布 Claude Fable 5.1,编程基准通过率较前代翻倍,虽定价翻倍但缓存成本降低 75%。

据 Woofun AI 消息,Anthropic 于 9 月 1 日发布 Claude Fable 5.1Claude Mythos 5.1,这是自 6 月 9 日推出 Fable 5 以来的首次更新。新模型定位为面向编程和知识工作的最先进模型,Fable 5.1 与 Mythos 5.1 共享同一底层模型,仅安全过滤器存在差异。

在性能表现上,Fable 5.1 在 Terminal-Bench-Science 0.1 基准中通过率达 52.6%,较 Fable 5 的 24.7% 实现翻倍以上增长,并领先 Opus 5 的 29%;在 Terminal-Bench 4 基准中得分为 55.8%,高于 Fable 5 的 42% 及 Opus 5 的 52.3%。目前 Fable 5.1 已向所有 Claude 账户开放,而 Mythos 5.1 仅限通过特定验证计划的专业人士使用。

定价方面,Fable 5.1 输入每百万 token 收费 10 美元,输出收费 50 美元,价格为 Opus 5 的两倍。不过,其缓存读取成本降低了 75%,使得典型工作负载成本下降约 25%,高 agentic 工作负载成本最多可下降 45%。

WOOFUN AI

影响力评估 · 一键速读

Claude Fable 5.1 在编程基准上的显著跃升,标志着 Anthropic 在垂直领域模型能力上的进一步巩固,直接对标并超越内部旗舰 Opus 5。尽管名义单价翻倍,但通过大幅降低缓存读取成本,实际使用成本反而下降,这一策略旨在吸引高频调用的高价值开发者用户。若该模型在真实开发场景中保持基准测试优势,或将对其他主打编程能力的 AI 模型形成竞争压力。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅