MiniMax H3 Max 是什么?
MiniMax H3 Max 是一个支持文字转视频、图片转视频和首尾帧的视频模型。分镜时长 5–15 秒,480P 或 720P。在 SunoMV 里选它的 key 是 h3-max,用来迭代短的 MV 分镜,不是用来出原生 2K 或对嘴型的演唱画面。
H3 Max 是专门用来迭代分镜的模型——快、省钱。5–15 秒短片,480P 或 720P,首尾帧转场衔接歌词分镜。我们实测一个 5 秒 480P 分镜,5.41 秒就出片。今天就要出整首歌的预览,不是 2K 大片?在 SunoMV 里选它。
H3 Max 是分镜级的杠杆:时长、成本、周转速度。Hailuo 03 / MiniMax H3 是系列级的杠杆:原生 2K、口型同步、多参考锁定。要把二十个歌词分镜排出来看看效果行不行,H3 Max 就是默认选项——我们实测一个 5 秒 480P 分镜 5.41 秒出片,$0.125(约 ¥0.9)。已经确定分镜、需要 2K 对嘴型?换模型。别指望这一页两头都占。
一支 MV 就是一堆短片叠出来的。中午前要出二十个分镜?该拿的是 H3 Max——不是要一个原生 2K、带口型同步的特写镜头的时候。
选择器上标的生成时间大概 10 秒一条。我们在 2026 年 8 月 27 日自己实测——文字转视频、5 秒、480P、16:9——提交 2.62 秒,云端处理约 2.8 秒,全程 5.41 秒。二十个分镜是几分钟的事,不是几个小时。
选择器里显示的额度:720P 每 5 秒分镜 160 积分,480P 每 5 秒 100 积分。整首歌先用 480P 打草稿,副歌再用 720P 重跑一遍——不用每次尝试都烧大片预算。
文字转视频、图片转视频、首尾帧,选择器里都有。把这句歌词的最后一帧锁定成下一句的第一帧,剪辑才不会一句一换脸。
三个 MiniMax 名字挨在一起,选错就白生成一次。这页说的只是那个快的视频模型。
Hailuo 03——也叫 MiniMax H3——是更慢更重的视频模型:原生 2K、4K,音频参考做口型同步,多参考锁定。H3 Max 一个都不做。要 2K 大片或者对嘴型,选 Hailuo 03,不是这一页。
Music 3.0 是写歌的。H3 Max 是画面的。厂商前缀一样,选择器里的行不一样。先用音乐模型出歌,再用 H3 Max 剪视频——或者直接贴一个做好的 Suno 链接,在这儿分镜。
不支持参考图转视频,不支持音频参考,不做口型同步,没有原生 2K 或 4K。时长 5–15 秒——不是 3 秒或 4 秒。分辨率只有 480P 或 720P;填 1080P 会自动降到 720P。这些限制就是重点:更便宜、更快地迭代。
模型已经在视频选择器里了。不用申请 key,也不用离开做 MV 的流程。
打开创作流程,在视频模型里选 MiniMax H3 Max,设好 5–15 秒和 480P 或 720P。设置就这么多。
用文字描述场景,从一张静态图开始,或者给出首帧和尾帧,让分镜从这句歌词的画面走到下一句。
把每个分镜拖到歌词时间轴上,竖版、方版、宽屏都能预览,副歌剪得干净了就导出。预览整支片子不花钱。
不用装任何东西。模型已经在 SunoMV 的视频选择器里了。
打开创作页,选 MiniMax H3 Max,设好 5–15 秒,480P 打草稿或 720P 出成片。别管 1080P——它会自动降到 720P。
写场景描述,从一张静态图开始,或者设好首帧和尾帧让两句歌词的画面连起来。这里不做口型同步和 2K——那是 Hailuo 03 的事。
把分镜铺到歌词时间轴上。二十个 5 秒分镜,几分钟就生成完,不用等几个小时。预览免费,再导出竖版、方版或宽屏。
没有绝对更好的视频模型,只有更合适的。以下是这一行该出场的场合。
二十个 5 秒 480P 歌词分镜,就是整首歌便宜的分镜脚本。剪辑定了,再挑两三个满意的用 720P 重跑——或者直接交给 Hailuo 03。
首尾帧就是用来防止歌手服装每句都变的。把分镜 A 的结尾锁成分镜 B 的开头。
480P 每 5 秒 100 积分,就是迭代的价格。烂想法在这儿烧完,贵的模型只用来出你已经看中的分镜。
厂商前缀一样,选择器里的行不一样。点进去看,别瞎猜。
视频。快,5–15 秒 480P/720P 分镜,首尾帧,迭代额度。
视频。原生 2K/4K,口型同步,多参考。更慢,额度更高。不是这一页。
音频。写歌的。画面还是得靠视频模型。
MiniMax H3 Max 是一个支持文字转视频、图片转视频和首尾帧的视频模型。分镜时长 5–15 秒,480P 或 720P。在 SunoMV 里选它的 key 是 h3-max,用来迭代短的 MV 分镜,不是用来出原生 2K 或对嘴型的演唱画面。
MiniMax H3,也叫 Hailuo 03,是另一个视频模型,有原生 2K/4K、音频参考口型同步和多图参考。MiniMax H3 Max 砍掉了这些能力,换来更短的周转时间和更低的分镜额度(480P 和 720P)。它们不是同一个东西的两个叫法。
首尾帧分镜是一个生成的短片,开头画面和结尾画面都是用户给的。模型负责补全中间的运动,这样连续的歌词句才能在剪辑处保持同一个人物、同一套服装、同一个机位。
这一页说的能力边界跟 SunoMV 模型选择器一致。耗时和 API 成本是我们 2026 年 8 月 27 日的实测数据,不是厂商的宣传数字。
MiniMax H3 Max 在 SunoMV 视频选择器里是一行可选模型,支持文字转视频和图片转视频,包括首尾帧路径。
SunoMV — 视频模型选择器(h3-max) ↗我们的实测,2026 年 8 月 27 日:文字转视频,5 秒,480P,16:9。提交 2.62 秒;云端处理约 2.8 秒;全程 5.41 秒;API 成本 $0.125(约 ¥0.9)。样片保存自这次实测。
SunoMV — 实测数据 2026-08-27 ↗MiniMax H3 Max 的公开发布,定位为一个快速的 5 秒级视频模型,区别于 Hailuo 03 / MiniMax H3 那条线。
MiniMax H3 Max — 官方公告 ↗常见问题
有问题?问我们!
5–15 秒,480P 或 720P,剪辑要衔接就用首尾帧。整首歌的预览免费看,导出直接发 TikTok、Reels、Shorts 和 YouTube。