Tomadas narrativas
Controle como uma cena começa, se desenvolve e termina na composição final.
Vídeo multimodal MiniMax
Modelo de vídeo multimodal da MiniMax para texto para vídeo, animação de primeiro/último quadro e orientação por referências de imagem, vídeo ou áudio.
De frames ao movimento final
Os frames limite estabelecem a composição, o prompt dirige a ação e o H3 cria o movimento entre eles. Assim fica mais fácil entender o caminho de geração antes de gastar créditos.
Experimentar este fluxoEnvie um frame inicial, final ou ambos para definir onde a tomada começa e termina.
Diga ao H3 o que muda entre os frames: ação do sujeito, movimento de câmera, ritmo e som.
“The car revs through the desert.”
O H3 monta um clipe contínuo preservando a composição de abertura e encerramento pretendida.
Gere vídeo de 4–15 segundos em 768P ou 2K a partir de texto, frames inicial e final, ou referências de imagem, vídeo e áudio.
Criar com MiniMax H3Controle como uma cena começa, se desenvolve e termina na composição final.
Use imagens de referência para guiar sujeitos recorrentes e identidade visual.
Use referências de vídeo e áudio para moldar movimento, linguagem de câmera, voz e ritmo.
Anime uma imagem de abertura, termine em uma final ou use ambas para definir o arco da tomada enquanto o H3 constrói o movimento intermediário.
“The car revs through the desert.”
Atribua imagens a personagem ou estilo, vídeo a movimento ou linguagem de câmera, áudio a voz ou ritmo de edição. O H3 aceita até 9 imagens, 3 vídeos e 3 clipes de áudio.
Explore o ritmo em 768P e renderize a direção escolhida em 2K. Escolha de 4 a 15 segundos e veja a estimativa de créditos antes de gerar.
Comece pelo assunto; depois acrescente iluminação, estilo e tudo o que precisa ficar igual. Envie uma referência sempre que quiser uma edição mais controlada.
Explique se uma referência controla personagem, movimento, câmera, estilo, som ou ritmo.
Escolha frames inicial e final compatíveis e descreva a transição entre eles.
Valide movimento e composição com menor custo antes de gerar a versão final em 2K.
Controle multimodal avançado, geração de alta fidelidade ou variante de produção mais rápida.
| Recurso | MiniMax H3Atual | ||||||
|---|---|---|---|---|---|---|---|
| Melhor para | Direção cinematográfica multimodal | Produção rápida guiada por referências | Iteração na velocidade máxima | MiniMax's high-fidelity video model for realistic human motion, cinematic effects, and expressive character performance. | A faster, lower-cost Hailuo 2.3 variant for image-to-video iteration and production volume. | MiniMax's efficient video model with text-to-video, image animation, and optional first-to-last-frame control. | A low-cost 512p Hailuo 02 variant for rapid concepts with optional first and last frame guidance. |
| Entrada | Texto, imagem, vídeo ou referências de áudio | Texto, frames, imagem, vídeo ou referências de áudio | Texto ou frames inicial e final | Texto para vídeo · Imagem para vídeo | Imagem para vídeo | Texto para vídeo · Imagem para vídeo | Texto para vídeo · Imagem para vídeo |
| Resolução | 768P ou 2K | 480P, 768P ou 1080P | 480P, 768P ou 1080P | 768p or 1080p | 768p or 1080p | 512p, 768p, or 1080p | 512p |
| Controle de frames | Frames inicial e final | Frames inicial e final | Frames inicial e final | First frame | First frame | First frame · Last frame | First frame · Last frame |
| Velocidade | Carro-chefe | Mais rápido que em tempo real | Mais rápido | Hailuo 2.3 | Hailuo 2.3 Fast | Hailuo 02 | Hailuo 02 Fast |
Explore modelos de imagem populares fora desta série, ou confira o catálogo completo.




Comece com texto, frames limite ou referências multimodais e revise a estimativa de créditos antes de gerar.