降价 90% 性能碾压:Anthropic Haiku 5.5 发布
核心要点
Anthropic推出最廉价Claude模型Haiku 5.5,输入输出价格降至0.10/0.50美元每百万Token,性能在OSWorld等测试中大幅领先OpenAI竞品,并提供API补贴。
据 Woofun AI 消息, 于周三正式发布了 版本,将其定位为该公司迄今为止开发出的最便宜、最快且功能最强的小型 AI 模型。
这一发布标志着 Anthropic 在轻量级模型领域的战略重心进一步下沉,旨在通过极致的性价比优势,抢占那些对成本敏感且对响应速度有极高要求的细分市场。该模型的核心应用场景被明确界定为处理大量重复性任务,例如文档总结、数据库查询,以及需要实时交互的客户支持和网页操作辅助。
这种定位并非简单的功能缩减,而是针对特定高频、低复杂度场景的精准优化,试图在保持基本智能水平的同时,将推理成本压缩至行业最低水平,从而为开发者提供更具吸引力的集成选项。
在定价策略上,Anthropic 采取了极具侵略性的价格战手段。对于长度不超过 10 万 Token 的输入内容,收费标准定为每百万 Token 0.10 美元;输出内容则定为每百万 Token 0.50 美元。Token 作为 AI 模型读取和生成文本的基本单位,其长度约相当于四分之三个单词,是业界通用的计费基准。
这一价格体系与 在 9 月 22 日推出的竞品 完全持平,显示出两家巨头在入门级模型定价上的直接对标。相比之下,上一代 版本的收费分别为每百万输入 Token 1 美元和每百万输出 Token 5 美元,这意味着新版本的单价降幅高达 90%。
此外,针对长度超过 10 万 Token 的长输入内容,用户还可享受 50% 的折扣。Woofun AI 整理数据显示,由于旧版本中约 90% 的请求都属于短文本范围,且 Haiku 5.5 在文本分词效率上进行了优化,将文本拆分为更多 Token,Anthropic 预计用户的平均成本将节省近 75%。
尽管该模型最初是为处理客户支持对话和长邮件总结等低创造力需求任务而设计,但其定价逻辑显然意在通过规模效应迅速扩大市场份额,迫使竞争对手在成本结构上进行重新评估。
尽管定位为'廉价'模型,基准测试数据却揭示了 Haiku 5.5 在性能上的意外强势,甚至在多项指标上超越了更昂贵的竞品。在评估 AI 通过多步骤任务操作真实计算机能力的 测试中,Haiku 5.5 取得了 72.4% 的成功率,而 OpenAI 的 仅为 48.9%,显示出其在复杂交互任务上的显著优势。在要求 AI 智能体通过输入命令自行完成专业任务的 测试中,Haiku 5.5 的首次尝试正确率为 39.2%,远超 Luna 的 16.4%,更令上一代 Haiku 4.5 的 0% 成绩相形见绌。作为内部参照,Anthropic 自家的 在该测试中得分为 70.6%,表明 Haiku 5.5 已接近中高端模型的水平。
然而,这种性能提升并非没有代价或局限。在简单的逻辑问题测试中,尽管 Haiku 5.5 响应速度极快,几乎瞬间给出答案,但结果却是错误的,这提醒用户在处理关键逻辑推理时仍需保持谨慎,不可盲目信赖。在采用国际象棋 Elo 评分系统、基于 44 种职业实际工作表现进行评分的 测试中,Haiku 5.5 获得 1620 分,高于 Luna 的 1437 分和 Haiku 4.5 的 735 分,进一步印证了其综合能力的跃升。

评论
暂无评论