利好

Ant L3.0-flash开源,FP8版仅占128GB内存

2026-08-05 15:35

inclusionAI发布Ling-3.0-flash,1240亿参数模型FP8量化后性能偏差仅1.57分。

据 Woofun AI 消息,AntBabel(inclusionAI)正式开源 Ling-3.0-flash 模型权重,提供 BF16 与 FP8 两种格式,均采用 MIT 许可证。该模型拥有 1240 亿参数,支持 256,000 Token 上下文,单次生成仅激活 51 亿参数,主要面向编程及 Agent 任务。BF16 版本权重约 255GB,FP8 版本降至 128GB,官方基准测试显示两者性能最大偏差仅为 1.57 分。

WOOFUN AI

影响力评估 · 一键速读

Ling-3.0-flash 通过稀疏激活架构,以百亿级参数量实现与万亿级模型相当的性能,大幅降低部署门槛。FP8 量化将显存需求减半且精度损失极小,有利于在消费级硬件上运行高性能 Agent。此举或推动开源社区对高效推理架构的关注,加剧中小模型在垂直领域的竞争。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅