MiniMax H3 是 MiniMax 推出的最新视频模型,该公司也是 Hailuo 系列视频模型的开发方。它于 2026 年 7 月 31 日发布。
H3 相比之前的 Hailuo 模型是一次巨大飞跃。它能生成更清晰的画面、更长的片段,还能自动添加声音。现在就来 OpenArt 体验 MiniMax H3 吧。
要点总结
- MiniMax H3 以每秒 24 帧生成原生 2K 视频。
- 单次生成的片段时长为 5 至 15 秒。
- 该模型在生成画面的同时还会生成配音、音效和背景声。
- 最多可上传 9 张图片、3 段视频和 3 段音频作为参考。
- 只需输入想改动的内容,就能修改一段成品视频。
什么是 MiniMax H3?
MiniMax H3 是 MiniMax 所称的全模态模型。也就是说,单个模型可以同时读取四种输入:你的文字、图片、视频和音频文件。
旧版视频模型只能读取文字和一张图片。Hailuo 3.0 指的就是同一款模型,所以你在网上会看到这两个名字。
MiniMax H3 能做什么
直出清晰 2K 视频,无需额外放大处理
H3 直接从模型生成 2K 视频。旧版模型只能生成 768p 或 1080p 视频,你还得用 AI 视频放大工具才能放大。原生 2K 的视频在电视、门店屏幕或客户的大显示器上都能完美呈现。
同一段视频,画面与声音同步生成
H3 在生成画面时同步生成声音。你会得到配音、音效和环境声,全部与画面中的动作对齐。台词对得上口型,玻璃杯破碎的瞬间就会响起碰碎声。
从你自己的文件中复刻角色、外观或声音
你最多可以上传 9 张图片、3 段短视频和 3 段音频作为示例。H3 会将其中的面孔、服装、艺术风格、动作方式或声音复刻到你的新视频中。搭配使用 OpenArt Characters 让每一段片段中都保持同一个人物。
只需输入想改动的内容即可修改视频
生成满意的视频后,想改一处内容不必从头再来。只需输入类似“把夹克改成红色”或“把走路速度放慢”这样的指令,H3 就只改动那一处,保留你已认可的其他部分。目前 H3 在 Artificial Analysis 视频编辑榜单上位列第一。
在一段视频中拍出多个镜头
H3 能在一段 15 秒的视频中放入多个镜头。你可以获得一个开场镜头、一个特写和一个结尾镜头,而无需把三段独立视频拼接在一起。
MiniMax H3 规格参数
| 规格 | 你能获得 |
|---|---|
| 分辨率 | 原生 2K |
| 时长 | 每段视频 5 至 15 秒 |
| 帧率 | 每秒 24 帧(固定) |
| 形状 | 21:9、16:9、4:3、1:1、3:4、9:16 或自动 |
| 多种上手方式 | 仅文字、首帧或尾帧图片,或参考文件 |
| 参考文件 | 最多 9 张图片、3 段视频、3 段音频 |
参考视频和音频每段时长需在 2 到 15 秒之间,且总时长不能超过 15 秒。
MiniMax H3 与旧版 Hailuo 模型对比
Hailuo 02 是物理模型,擅长真实动态,比如水花飞溅或身体坠落,还允许你同时设置首帧和尾帧。它能以 768p 或 1080p 生成 6 秒或 10 秒的片段。
接下来推出的 Hailuo 2.3 偏向艺术风格,擅长动漫、插画、水墨画和游戏美术,运行成本也更低。但 2.3 的 1080p 只支持 6 秒片段,10 秒片段会降回 768p。
两款旧模型都不能生成声音,也都不支持上传一批参考文件或通过输入文字来编辑。
| 模型 | 最佳视频尺寸 | 最长片段 | 能生成声音吗? |
|---|---|---|---|
| Hailuo 02 | 1080p | 10 秒 | 否 |
| Hailuo 2.3 | 1080p(仅限 6 秒) | 768p 下 10 秒 | 否 |
| MiniMax H3 | 原生 2K | 15 秒 | 是 |
简而言之就是:当你需要一段带声音的成品视频、更长的片段,或让同一角色在多个镜头中连续出现时,选 MiniMax H3。而如果你想要更省钱的动漫或插画片段,也仍可使用 Hailuo 2.3。
在 OpenArt 上试试 MiniMax H3
MiniMax H3 现已上线 OpenArt 的 AI 视频生成器。从模型列表中选择 MiniMax H3,输入你想要的内容,如果有参考文件也可以上传。
把你想要的台词和声音都写出来,因为 H3 也会生成音频。先用 5 秒测试你的创意,画面效果满意后再生成完整的 15 秒。这样只有在确定可行时,才会为长视频付费。