MiniMax H3 是一款 AI 视频生成器,结合了多模态理解、2K 分辨率、原生音频和基于指令的编辑于一体。
MiniMax H3 是一个通用的多模态视频模型,能够生成 2K 的 4 到 15 秒的剪辑。图像、视频和音频一起进入一个请求——H3 读取所有这些内容中的角色、动作、情感、镜头语言和风格,然后将它们融合成一个连贯的场景,声音与画面同时生成。编辑的方式也是一样:指向一个角色、物体、背景或对话台词并描述更改,其他一切保持不变。专为广告、电子商务、品牌、短剧和游戏内容而设计。在人工分析中,视频编辑排名第一。