利好
Claude Sonnet 5.5 编程得分超 Opus 5.5
04:10
据 Woofun AI 消息,Anthropic 于本周一发布 ,这是继今年 6 月推出 后的升级版本。官方表示,该中端模型运行速度较上一代提升超过 30%,在修复缺陷、制作文档及幻灯片等明确任务中表现突出,并具备敏锐的设计能力。定价维持每百万输入 token 2 美元、每百万输出 token 10 美元,为 的一半,且单任务 token 消耗较 Sonnet 5 减少近三分之一。
在 Terminal-Bench 4 测试中,Sonnet 5.5 得分为 70.6%,高于 Opus 5.5 的 66.4% 和 Sonnet 5 的 10.3%。独立机构 Artificial Analysis 测试显示,Sonnet 5.5 录得 63.6%,领先 Opus 5.5 的 59.6% 及 OpenAI 的 59.1%。在评估 44 类职业真实工作表现的 GDPval-AA 上,Sonnet 5.5 获 1844 分,与 Opus 5.5 的 1846 分基本持平,显著高于 的 1487 分。
WOOFUN AI
影响力评估 · 一键速读
Sonnet 系列以更低成本实现超越旗舰模型的编程性能,标志着 AI 模型性价比竞争进入新阶段。速度提升与 token 消耗降低将直接利好开发者生态,可能加速企业级应用落地。在通用职业能力评估中与 Opus 持平,说明中端模型已具备替代高端模型处理复杂任务的潜力,或引发行业定价策略调整。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论
暂无评论