登录
注册
据 Woofun AI 消息,谷歌正在研发一款名为 Frozen v2 的人工智能推理芯片,计划最早于 2028 年投入实际应用。该芯片会将 Gemini 架构的部分内容直接固化在硬件内部,以降低运行模型时的计算负荷与数据传输需求。内部预测显示,Frozen v2 每瓦特所能处理的 token 数量将是现有最先进 TPU 的 6 到 10 倍。
此举旨在缓解当前迫使谷歌云拒绝部分外部客户订单的算力短缺问题。Frozen v2 将与通用性更强的 TPU 共存,前者以牺牲灵活性为代价换取极致效率。然而,这也构成了一次架构层面的风险:若未来 Gemini 架构发生重大调整,专用芯片可能面临失去使用价值的困境。