叙事镜头
控制场景如何开始、发展并落在最终构图。
MiniMax 多模态视频
MiniMax 多模态视频模型,支持文生视频、首尾帧动画,以及图片、视频或音频参考引导。
上传首帧、末帧或两者,定义镜头从哪里开始、落在哪里。
告诉 H3 帧之间发生什么变化,包括主体动作、运镜、节奏与声音。
“The car revs through the desert.”
H3 构建连续片段,同时保留预期的开场与结束构图。
控制场景如何开始、发展并落在最终构图。
用参考图引导反复出现的主体与视觉识别。
用视频与音频参考塑造运动、镜头语言、语音与节奏。
让开场图动起来、落在最终图,或两者并用定义镜头弧线,H3 在中间构建运动。
“The car revs through the desert.”
图像指定角色或风格,视频指定运动或镜头语言,音频指定语音或剪辑节奏。H3 最多接受 9 张图、3 段视频、3 段音频。
768P 探索节奏,选定方向后 2K 渲染。时长 4–15 秒可选,生成前可查看积分估算。
先写清主体,再补充光影、风格,以及必须保持不变的内容。需要更可控的编辑时,上传参考图。
说明参考控制的是角色、运动、镜头、风格、声音还是节奏。
选择兼容的首末帧,再描述两者之间的过渡。
以更低成本验证运动与构图,再生成最终 2K 版本。
在前沿多模态控制、高保真生成与更快量产变体之间选择。
| 功能 | MiniMax H3当前 | ||||||
|---|---|---|---|---|---|---|---|
| 最适合 | 多模态电影感导演 | 快速、参考引导制作 | 极速迭代 | MiniMax 高保真视频模型,适合真实人体动作、电影感特效与富有表现力的角色表演。 | 更快的低配 Hailuo 2.3 变体,适合图生视频迭代与批量生产。 | MiniMax 高效视频模型,支持文生视频、图像动画及可选的首尾帧控制。 | 低成本 512p Hailuo 02 变体,适合快速概念验证及可选首尾帧引导。 |
| 输入 | 文字、图像、视频或音频参考 | 文字、帧、图像、视频或音频参考 | 文字或首尾帧 | 文生视频 · 图生视频 | 图生视频 | 文生视频 · 图生视频 | 文生视频 · 图生视频 |
| 分辨率 | 768P 或 2K | 480P、768P 或 1080P | 480P、768P 或 1080P | 768p or 1080p | 768p or 1080p | 512p, 768p, or 1080p | 512p |
| 帧控制 | 首尾帧 | 首尾帧 | 首尾帧 | 首帧 | 首帧 | 首帧 · 尾帧 | 首帧 · 尾帧 |
| 速度 | 旗舰 | 快于实时 | 最快 | Hailuo 2.3 | Hailuo 2.3 Fast | Hailuo 02 | Hailuo 02 Fast |