MiniMax 發布全模態生成模型 H3,一個模型包辦圖片、視頻和聲音
2026-07-31 10:27:00
幣界網消息,MiniMax 發布全模態生成模型 H3,該模型能夠同時理解文字、圖片、視頻和聲音,並根據自然語言指令生成或編輯視頻。用戶可以讓 H3 照著一段視頻學習鏡頭運動,使用另一張圖中的人物,再參考第三段音頻的聲音。H3 最長可生成15秒視頻,支持2K解析度和原生雙聲道聲音。官方 API 的2K價格為每秒0.13美元,生成一段15秒視頻約需1.95美元;768p解析度每秒0.09美元。一次任務最多可輸入9張圖片、3段視頻和3段音頻,總數不能超過12個文件。MiniMax 計劃未來幾天開放模型權重。
利好 0
利空 0
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。