利好
MiniMax发布全模态模型H3支持多源视频生成
2026-07-31 10:27:40
H3可整合文本、图像、音视频指令生成2K视频,15秒成本约1.95美元,权重即将公开。
据 Woofun AI 消息,MiniMax 发布全模态生成模型 H3,该模型支持同时理解文本、图像、视频及音频,并依据自然语言指令生成或编辑视频。H3 允许用户在同一任务中整合动作迁移、人物引用及声音克隆等操作,生成的视频最长可达 15 秒,支持 2K 分辨率与原生立体声。API 定价方面,2K 视频每秒 0.13 美元,768P 视频每秒 0.09 美元,单次任务最多输入 9 张图像、3 段视频和 3 个音频片段。MiniMax 计划近日公布模型权重参数,目前尚未披露针对 Seedance 和 Veo 等竞品的官方评估结果。
WOOFUN AI
影响力评估 · 一键速读
H3 将多模态编辑整合为单一任务,显著降低视频创作门槛并提升效率。2K 视频单次生成成本控制在 2 美元以内,具备较强的商业化竞争力。权重参数的公开将加速社区对该模型能力的验证与二次开发,可能进一步加剧 AI 视频生成领域的技术竞争。
WOOFUN AI 生成 · 仅供参考,非投资建议
评论
暂无评论