利好
腾讯 Hy4 盲测胜 GLM-5.3,输出价低 82%
14:47
163名专家盲测中Hy4得分领先,虽部分基准测试落后,但输出成本较竞品低82%。
Woofun AI 获悉,腾讯公布了 Hy4 preview 的内部工程盲测结果。在由 163 名内部专家对 203 个真实工程任务进行的评估中,Hy4 平均得分为 2.99/4,高于 GLM-5.3 的 2.92/4 和 Kimi K3 的 2.94/4。具体对比显示,Hy4 对 GLM-5.3 的胜率为 46.8%,对 Kimi K3 的胜率为 51.2%。
尽管在 DeepSWE、CyberGym 等代码与网络安全基准测试中 Hy4 仍落后于 GLM-5.3,但其价格优势显著。Hy4 每百万 Tokens 输入 6 元、输出 18 元,输出价格较 Kimi K3 低 82%,较 GLM-5.3 低 36%。缓存命中费用为 0.3 元,比两款竞品低 85%。
WOOFUN AI
影响力评估 · 一键速读
Hy4 在真实工程场景盲测中取得领先,验证了其在实际业务中的可用性,但基准测试的短板提示其技术全面性仍有提升空间。极具竞争力的定价策略,尤其是大幅低于竞品的输出与缓存成本,或使其在追求性价比的企业级应用中快速获得市场份额。这种‘性能持平、价格碾压’的策略可能加剧大模型市场的价格战,迫使其他厂商跟进降价或优化成本结构。
WOOFUN AI 生成 · 仅供参考,非投资建议
评论
暂无评论