利好

MiniMax发布全模态模型H3支持多源视频生成

2026-07-31 10:27:40

H3可整合文本、图像、音视频指令生成2K视频,15秒成本约1.95美元,权重即将公开。

据 Woofun AI 消息,MiniMax 发布全模态生成模型 H3,该模型支持同时理解文本、图像、视频及音频,并依据自然语言指令生成或编辑视频。H3 允许用户在同一任务中整合动作迁移、人物引用及声音克隆等操作,生成的视频最长可达 15 秒,支持 2K 分辨率与原生立体声。API 定价方面,2K 视频每秒 0.13 美元,768P 视频每秒 0.09 美元,单次任务最多输入 9 张图像、3 段视频和 3 个音频片段。MiniMax 计划近日公布模型权重参数,目前尚未披露针对 SeedanceVeo 等竞品的官方评估结果。

WOOFUN AI

影响力评估 · 一键速读

H3 将多模态编辑整合为单一任务,显著降低视频创作门槛并提升效率。2K 视频单次生成成本控制在 2 美元以内,具备较强的商业化竞争力。权重参数的公开将加速社区对该模型能力的验证与二次开发,可能进一步加剧 AI 视频生成领域的技术竞争。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅