价格腰斩性能暴涨:Claude Haiku 5.5 重塑 AI 性价比
核心要点
Anthropic 发布 Claude Haiku 5.5,价格较前代降 90%,跑分全面超越 GPT-6 Luna。本文详解其定价策略、性能对比及作为子 Agent 的高效应用场景。
据 Woofun AI 消息, 正式推出 ,这款新模型以价格暴降 90% 的激进策略切入市场,旨在重新定义行业内的算力成本基准。此次发布不仅标志着 Anthropic 在轻量化模型领域的重大突破,更通过极致的性价比组合,对现有 AI 服务格局发起直接挑战。核心事实在于, 在大幅削减费用的同时,实现了性能的显著跃升,特别是在多项关键基准测试中超越了竞争对手 的 ,展现出强大的市场竞争力。
在精细化定价体系与成本测算方面, 5.5 的单价设定极具侵略性。其价格仅为上一代 的 1/10,以及 的 1/20,且与 OpenAI 的 GPT-6 保持同价。具体而言,针对提示在 10 万 Token 以内的请求,输入价格为每百万 Token 0.10 美元,输出价格为 0.50 美元;若超过 10 万 Token,则输入价格调整为 0.50 美元,输出价格升至 2.50 美元。
此外,缓存读取费用低至每百万 Token 0.01 美元,若采用批处理模式还可享受五折优惠。Woofun AI 整理数据显示,官方测算表明,执行相同任务时,Haiku 5.5 平均比 Haiku 4.5 节省约 75% 的成本,同等预算下调用量可提升至四倍。未能实现九成降幅的主要原因在于,超过 10 万 Token 的请求仅便宜一半,而上一代 Haiku 约九成请求均在 10 万 Token 以内,且新分词器导致同样文本多出三成左右的 Token。相比之下,GPT-6 Luna 在长上下文场景中更具价格优势,其直到 27 万 Token 左右才涨价,涨后输入为 0.20 美元、输出为 0.75 美元。
同时, 5.5 的缓存读取费用也从今日起减半,从每百万 Token 0.20 美元降至 0.10 美元,官方预计多数 Agent 任务因此可节省两成左右。在订阅服务方面,Max 和 Team 订阅本周起每月赠送 API 额度,Max 5x 赠送 100 美元,Max 20x 赠送 200 美元,Team 最多赠送 500 美元供全队共用,这些额度可在 上用于任何模型。
在基准测试跑分与竞品横向对比中,Haiku 5.5 的表现令人瞩目。在操作电脑的 OSWorld 测试中,其得分从上一代的 15.7% 飙升至 72.4%,仅比 Sonnet 5.5 低 11.5 个百分点。在终端编程的 Terminal-Bench 4.0 测试中,上一代得分为零,而 Haiku 5.5 取得了 39.2% 的成绩。在知识工作的 GDPval-AA 测试中,Haiku 5.5 拿下 1620 分,是上一代的两倍多。在"人类最后的考试"HLE 中,不带工具的情况下,得分从 10.2% 涨至 45.9%。
值得注意的是,在官方跑分表里 Luna 交了成绩的六项中,Haiku 5.5 全部胜出,且多项成绩紧咬 Sonnet。具体来看,在 OSWorld 上,同价的 Luna 仅得 48.9%,Haiku 5.5 甩开它 23.5 个百分点;即便 Haiku 5.5 仅开启 Medium 档,其表现也超过了 Luna 满档的成绩,且成本更低。在 GDPval-AA 上,Haiku 5.5 的 1620 分压过 Luna 的 1437 分,虽不及 Sonnet 5.5 的 1840 分,但默认 Medium 档也有 1277 分。

评论
暂无评论