利好

MiniMax發佈全模態模型H3支持多源視頻生成

2026-07-31 10:27:40

H3可整合文本、圖像、音視頻指令生成2K視頻,15秒成本約1.95美元,權重即將公開。

據 Woofun AI 消息,MiniMax 發佈全模態生成模型 H3,該模型支持同時理解文本、圖像、視頻及音頻,並依據自然語言指令生成或編輯視頻。H3 允許用戶在同一任務中整合動作遷移、人物引用及聲音克隆等操作,生成的視頻最長可達 15 秒,支持 2K 分辨率與原生立體聲。API 定價方面,2K 視頻每秒 0.13 美元,768P 視頻每秒 0.09 美元,單次任務最多輸入 9 張圖像、3 段視頻和 3 個音頻片段。MiniMax 計劃近日公佈模型權重參數,目前尚未披露針對 SeedanceVeo 等競品的官方評估結果。

WOOFUN AI

影響力評估 · 一鍵速讀

H3 將多模態編輯整合爲單一任務,顯著降低視頻創作門檻並提升效率。2K 視頻單次生成成本控制在 2 美元以內,具備較強的商業化競爭力。權重參數的公開將加速社區對該模型能力的驗證與二次開發,可能進一步加劇 AI 視頻生成領域的技術競爭。
WOOFUN AI 生成 · 僅供參考,非投資建議

評論

回覆 @用戶
0/800

暫無評論

消息提醒

登入後查看消息
查看全部消息管理訂閱