MiniMax发布全模态生成模型H3,一个模型包办图片、视频和声音
2026-07-31 10:27:00
币界网消息,MiniMax发布全模态生成模型H3,该模型能够同时理解文字、图片、视频和声音,并根据自然语言指令生成或编辑视频。用户可以让H3照着一段视频学习镜头运动,使用另一张图中的人物,再参考第三段音频的声音。H3最长可生成15秒视频,支持2K分辨率和原生双声道声音。官方API的2K价格为每秒0.13美元,生成一段15秒视频约需1.95美元768p每秒0.09美元。一次任务最多可输入9张图片、3段视频和3段音频,总数不能超过12个文件。MiniMax计划未来几天开放模型权重。
来源:互联网
本内容只为提供市场信息,不构成投资建议。
关注HQYC官方账号,及时关注最新动态






