利好
OpenAI 自研推理芯片 Jalapeño 能效超英伟达 1.9 倍
07:41
Jalapeño实测每瓦AI产出领先1.5至1.9倍,延迟最高降3.6倍,计划年底前部署。
据 Woofun AI 消息,OpenAI 公布首款定制推理芯片 Jalapeño 的实测数据,称其在能效与延迟上超越英伟达 GB300。该芯片在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 模型测试中处于帕累托最优前沿,峰值每瓦 AI 产出高出 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍;在高交互智能体场景下,优势扩大至 2.1 至 4.1 倍。Jalapeño 额定功率 700 瓦,实测持续功率不超过 550 瓦。
Jalapeño 从设计到流片耗时 9 个月,AI 深度参与电路优化。借助 Codex 和 GPT-Astra,团队两个月内将三款未列入原始计划的开放权重模型优化至高性能,部分模块 AI 生成实现较人类手写快 1.5 至 1.8 倍。OpenAI 计划年底前部署该芯片,并继续大规模使用英伟达等外部加速器。Gen 2 已进入深度开发,Gen 3 正在成形。
WOOFUN AI
影响力评估 · 一键速读
OpenAI 自研芯片在能效比上的显著优势,可能降低大模型推理的边际成本,增强其在智能体等高负载场景下的竞争力。虽然短期内仍依赖英伟达算力,但多代芯片路线图的推进表明其正加速构建垂直整合的硬件护城河。若 Gen 2 及后续版本保持迭代速度,或将对 AI 基础设施供应链格局产生深远影响。
WOOFUN AI 生成 · 仅供参考,非投资建议
评论
暂无评论