MiniMax H3 2K
原生立体声 AI 视频生成

文字、图片、视频、音频一并输入。原生 2K、24fps,价格却远低于常规 2K。

在 Zeemo 上试用 MiniMax H3

MiniMax H3 一次生成,声画俱全

画面与声音同步生成。返回的成片自带配乐、对白与环境声——不用再等一轮音频制作才能用。

MiniMax H3 有何不同

一帧原生 2K 的 MiniMax H3 画面,旁边放大裁切显示标签文字依然清晰可读

一次生成就是 2K

MiniMax H3 输出原生 2K、24fps,单次生成时长 4 到 15 秒。放到原始尺寸看,细节依然清晰——标签文字看得清、边缘不模糊——放大到远超手机屏幕的画面上依然可用。

2K。24fps。一次生成。

生成 2K 视频
一个生成镜头,立体声波形与画面动作逐帧对齐

声音与画面同步而生

配乐、对白、拟音与环境声与画面一起建模生成,而不是事后添加。脚步声精准落在脚步上,空间听感符合场景本身,每次生成都自带原生立体声

无需后期。直接发布。

生成带声音的视频
图片、视频、音频参考文件围绕一个生成镜头摆放在 Zeemo 画布上

自带画风与声音参考

图片、视频片段和音频参考可以一起放入同一次生成——最多 9 张图片、3 段视频、3 段音频。一段参考录音能让角色的声音在多个镜头中保持一致。在 Zeemo 上,这些素材都放在画布中,把每个文件拖到对应位置即可。

九张图片。三段视频。三种声音。

前往画布创作
给定的首帧与尾帧,中间是模型生成的运动过程

说出想改的地方,即可编辑

像对人说话一样描述修改——把外套改成红色、去掉雨伞、把时间调到黄昏。MiniMax H3 会据此完成修改,不用重新写提示词。首帧与尾帧控制决定镜头从哪里开始、在哪里结束。

只说修改内容,不用重写提示词。

打开画布

如何在 Zeemo 上使用 MiniMax H3

无需安装,也不用配置本地环境。H3 直接在浏览器中运行,和你使用的其他模型共享同一个画布。

1

打开画布

Zeemo AI 画布的模型列表中选择 H3。

2

放入参考素材

最多 9 张图片、3 段视频、3 段音频。把每个素材放到它在镜头中该在的位置。

3

描述镜头,而不是堆砌形容词

描述动作、构图,以及你期望的声音。

4

生成并调整

打开声音回放查看效果。说出想改的地方,或替换一个参考素材,再次生成。

创作者们正在打造什么

常见
问题

MiniMax H3 是 MiniMax 推出的通用多模态生成模型,发布于 2026 年 7 月 31 日。它可以任意组合读取文字、图片、视频和音频,一次生成即返回原生 2K 视频,并同步生成立体声。修改只需用自然语言描述,首帧与尾帧控制决定镜头的开始与结束方式。

可以。MiniMax H3 AI 视频生成器在 Zeemo 画布中在线运行——从模型列表中选择它即可生成,无需安装任何软件。打开画布 →

原生 2K、24fps,单次生成时长 4 到 15 秒。支持六种画面比例,从 21:9 电影宽银幕到 1:1 方画幅,再到 9:16 竖屏。

单次生成最多可用 9 张图片、3 段视频和 3 段音频,文件总数不超过 12 个。其中一段音频可以是人声录音——模型会把这段声音带入生成的音频中,让角色在不同镜头之间保持同一个声音。在 Zeemo 上,这些素材直接放在画布上,而不需要在提示词里编号。体验画布 →

支持。给出一张静态图作为首帧、一张作为尾帧,或者两者都给,模型会生成中间的运动过程。图片也可以作为画风与角色参考,与提示词一起输入。

MiniMax H3 是更新一代的模型。它输出原生 2K 画质,画面与立体声同步生成,并支持图片、视频、音频参考同时输入——这些能力是早期 Hailuo 系列处理方式不同的地方。在 Zeemo 上,它运行在可视化画布中,与账号内的其他模型共存。查看方案 →

现在就在 Zeemo 上
生成你的第一条 2K 成片!

Get it on Google Play Download on the App Store
开始创作
MiniMax H3