利好

蚂蚁集团开源多模态大模型 Ling-3.0-flash-VL

12:17

该模型基于MoE架构,总参数量124B,原生支持图文视频输入,引入视觉反馈机制提升任务执行可靠性。

据 Woofun AI 消息,蚂蚁集团于 9 月 9 日正式发布并开源百灵系列首个原生多模态大模型 Ling-3.0-flash-VL。该模型基于 Ling-3.0-flash 的 MoE 架构拓展,总参数量为 124B,单次推理激活 5.5B 参数,原生支持图像、文本与视频输入,上下文窗口达到 256KToken。

Ling-3.0-flash-VL 引入视觉反馈机制,通过观察执行结果、对比目标、发现偏差及持续修正,将任务从一次性生成转变为闭环流程。该模型继承了前代在 Agent 工作流中的高效执行优势,旨在以更低成本和更短时间推进完整任务,同时原生多模态联合训练被证实能拉升文本智能。

WOOFUN AI

影响力评估 · 一键速读

蚂蚁集团通过开源 Ling-3.0-flash-VL,进一步丰富其 AI 基础设施布局,降低开发者接入多模态能力的门槛。引入视觉反馈闭环机制,标志着大模型从单纯的内容生成向具备自我修正能力的智能体演进,可能提升其在复杂真实场景中的落地效率。124B 总参数与 5.5B 激活参数的 MoE 架构设计,在保持高性能的同时兼顾推理成本,有助于推动多模态应用规模化部署。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅