利好
Ant L3.0-flash開源,FP8版僅佔128GB內存
2026-08-05 15:35
inclusionAI發佈Ling-3.0-flash,1240億參數模型FP8量化後性能偏差僅1.57分。
據 Woofun AI 消息,AntBabel(inclusionAI)正式開源 Ling-3.0-flash 模型權重,提供 BF16 與 FP8 兩種格式,均採用 MIT 許可證。該模型擁有 1240 億參數,支持 256,000 Token 上下文,單次生成僅激活 51 億參數,主要面向編程及 Agent 任務。BF16 版本權重約 255GB,FP8 版本降至 128GB,官方基準測試顯示兩者性能最大偏差僅爲 1.57 分。
WOOFUN AI
影響力評估 · 一鍵速讀
Ling-3.0-flash 通過稀疏激活架構,以百億級參數量實現與萬億級模型相當的性能,大幅降低部署門檻。FP8 量化將顯存需求減半且精度損失極小,有利於在消費級硬件上運行高性能 Agent。此舉或推動開源社區對高效推理架構的關注,加劇中小模型在垂直領域的競爭。
WOOFUN AI 生成 · 僅供參考,非投資建議
評論
暫無評論