登錄
註冊
據 Woofun AI 消息,谷歌正在研發一款名爲 Frozen v2 的人工智能推理芯片,計劃最早於 2028 年投入實際應用。該芯片會將 Gemini 架構的部分內容直接固化在硬件內部,以降低運行模型時的計算負荷與數據傳輸需求。內部預測顯示,Frozen v2 每瓦特所能處理的 token 數量將是現有最先進 TPU 的 6 到 10 倍。
此舉旨在緩解當前迫使谷歌雲拒絕部分外部客戶訂單的算力短缺問題。Frozen v2 將與通用性更強的 TPU 共存,前者以犧牲靈活性爲代價換取極致效率。然而,這也構成了一次架構層面的風險:若未來 Gemini 架構發生重大調整,專用芯片可能面臨失去使用價值的困境。