MiniMax发布全模态生成模型H3,一个模型包办图片、视频和声音
2026-07-31 10:27:00
币界网消息,MiniMax发布全模态生成模型H3,该模型能够同时理解文字、图片、视频和声音,并根据自然语言指令生成或编辑视频。用户可以让H3照着一段视频学习镜头运动,使用另一张图中的人物,再参考第三段音频的声音。H3最长可生成15秒视频,支持2K分辨率和原生双声道声音。官方API的2K价格为每秒0.13美元,生成一段15秒视频约需1.95美元768p每秒0.09美元。一次任务最多可输入9张图片、3段视频和3段音频,总数不能超过12个文件。MiniMax计划未来几天开放模型权重。
出典:互联网
このコンテンツは市場情報のみを提供するものであり、投資アドバイスを構成するものではありません。
HQYC公式アカウントをフォローして最新情報を入手
人気記事
更新

Ethereum: Quantum sells another 1,000 ETH to invest in AI data centers

The decline in AI concept stocks has triggered a deleveraging trend.

nft: Why has Bitfinex's ecosystem token LEO remained low-key for so long?

Anthropic disclosed that Claude had unauthorized access to three companies' systems during testing.

Web3: Foreign media: XRP under pressure, ZEC attempts to stabilize, HYPE hype cools down.

