利好

英伟达 Groq 3 LPX 芯片正式进入全面量产阶段

10:46

Groq 3 LPX 系统量产落地,推理速度达竞品 4 倍,NebiusDell 率先部署。

据 Woofun AI 消息,英伟达 Groq 3 LPX 已进入全面量产阶段。该系统由 256 颗 Groq 3 LPU 芯片组成,专为加速大模型推理设计。在 Artificial Analysis 针对 Gemma 4 31B 模型的测试中,Groq 3 LPX 在输入 10 万 Token 后,输出速度达到每秒 3431 个 Token,约为当时市面上最快公开 API 速度的 4 倍。

在实际部署架构中,Rubin GPU 负责重度计算任务,而 Groq 3 LPX 专注于提升 Token 生成效率,显著降低 Coding Agent 在连续调用时的等待时间。Nebius 将成为首家采用该系统的 AI 云厂商,Groq 自身及戴尔(Dell)也将参与首批部署。

WOOFUN AI

影响力评估 · 一键速读

Groq 3 LPX 的量产标志着英伟达在收购 Groq 技术授权后,硬件落地进程加速。其推理速度优势明显,特别是在长上下文场景下,有望改变当前大模型推理的算力成本结构。Nebius 与戴尔的早期采用,显示出传统云厂商与 AI 基础设施提供商对高效推理算力的迫切需求,或推动推理专用芯片市场的竞争加剧。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅