利好

疑似小米 MiMo-V3-Pro 跑分泄露 SWE-Bench 达 72.8

17:08

社群流传截图显示该模型在多项基准测试中表现优异,部分指标已逼近海外顶尖闭源模型水平。

据 Woofun AI 消息,8 月 21 日社群中流传一张疑似小米下一代大模型 MiMo-V3-Pro 的 Benchmark 测试截图。数据显示,该模型在 SWE-Bench Pro 测试中得分为 72.8 分,高于 GLM 5.3 的 67.9 分和 Kimi K3 的 65.8 分,与 Claude Opus 5 的 74.6 分及 GPT-5.6 Sol Max 的 75.4 分差距不足 3 分。

此外,MiMo-V3-ProTerminal-Bench 2.0 中取得 70.6 分,接近 Claude Opus 5 的 72.0 分和 GPT-5.6 Sol Max 的 73.5 分;在 τ3-bench 中得分为 76.4 分,略低于 GPT-5.6 Sol Max 的 78.8 分。目前小米官方尚未确认该截图真实性及 V3-Pro 版本的存在,最新公开旗舰仍为 MiMo-V2-Pro 系列。

WOOFUN AI

影响力评估 · 一键速读

若数据属实,小米大模型在代码生成与智能体场景的能力将显著缩小与海外头部模型的差距。SWE-Bench Pro 高分意味着其在复杂软件工程任务上具备较强竞争力,可能提升开发者生态关注度。鉴于目前仅为未经证实的社群爆料,市场需等待官方正式披露以验证技术落地能力。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅