Guia de Prompts MiniMax H3: Fórmula, Storyboards e Modelos
Aprenda a escrever prompts do MiniMax H3 para referências multimodais, imagem para vídeo, texto para vídeo, storyboards, diálogos, som e texto na tela.
Um prompt eficaz para vídeo com IA não precisa de dezenas de adjetivos nem do formato de um roteiro profissional. Ele precisa responder a três perguntas práticas:
- Qual é o papel de cada ativo de referência?
- Qual é a ideia central do vídeo?
- Como os visuais e o som devem se desenvolver ao longo do tempo?
Ao trabalhar com referências de texto, imagens, vídeo e áudio no MiniMax H3, você pode organizar essas instruções com uma fórmula simples:
Prompt completo = Instruções de ativos de referência + Conceito central + Sequência visual
Para projetos que exigem maior continuidade, fidelidade ao produto ou trabalho de câmera complexo, adicione uma seção final com requisitos de consistência e exclusões.
Parte 1: Defina o Papel de Cada Ativo de Referência
Ao enviar arquivos de referência, primeiro explique o que cada ativo deve controlar. Não presuma que o modelo identificará automaticamente a relação pretendida entre eles.
Os papéis de referência mais comuns incluem:
- Referência de personagem: Define o rosto, penteado, roupas e aparência geral.
- Referência de objeto: Define um produto ou adereço.
- Referência de cena: Define o ambiente, layout espacial e iluminação.
- Primeiro ou último quadro: Estabelece como o vídeo deve começar ou terminar.
- Referência de estilo: Orienta cor, textura e linguagem visual.
- Referência de composição: Orienta o posicionamento do sujeito e as relações visuais.
- Referência de movimento: Fornece movimento para uma pessoa ou objeto.
- Referência de câmera: Fornece um padrão de movimento de câmera.
- Referência de voz: Orienta a voz de um personagem.
- Reutilização de áudio: Usa todo ou parte de uma faixa de áudio enviada.
- Referência de edição de vídeo: Identifica elementos a adicionar, remover ou modificar em um vídeo existente.
Um bloco de referência pode ser assim:
@Image1 fornece o rosto, o penteado e o figurino da heroína.
@Image2 fornece o castelo escuro e a contraluz do início da manhã.
@Video1 fornece o movimento da dança.
@Audio1 fornece o ritmo musical e o clima geral.
Se um recurso precisar permanecer consistente, declare esse requisito diretamente:
Mantenha consistentes os traços faciais, o penteado prateado e o traje branco bordado da personagem em @Image1.
Parte 2: Defina o Conceito Central do Vídeo
O conceito central deve resumir o vídeo inteiro em uma frase. Inclua pelo menos:
- Sujeito: Quem ou o que aparece.
- Local: Onde a cena acontece.
- Evento: O que o sujeito faz.
- Formato e estilo: Anúncio, filme, animação, documentário ou outro tratamento.
- Regra de câmera: Um plano contínuo, cortes rápidos, filmagem aérea ou outro método.
Por exemplo:
Uma jovem cuja aparência segue @Image1 executa o movimento de dança com espada de @Video1
no pátio com flores de cerejeira de @Image2. Use um estilo realista e cinematográfico de época chinesa
e apresente a sequência como um único plano contínuo.
Mantenha essa afirmação concisa. Se a ideia central contiver vários personagens, locais ou histórias sem relação entre si, instruções detalhadas de planos ainda poderão ter dificuldade para manter o resultado coerente.
Parte 3: Descreva a Sequência Visual
Você pode estruturar a sequência visual por intervalo de tempo ou plano. Cada segmento deve explicar os elementos importantes:
- Tamanho do plano;
- Sujeito e ação;
- Movimento de câmera;
- Diálogo ou narração;
- Som ambiente, música e efeitos sonoros principais;
- Texto obrigatório na tela;
- Elementos que não devem aparecer.
Por exemplo:
0–3 segundos: Plano aberto. A mulher entra no pátio com flores de cerejeira pela esquerda.
O fundo está suavemente desfocado. Use apenas passos e folhas se movendo ao vento.
Sem diálogo.
3–8 segundos: Corte para plano médio. Ela desembainha a espada e assume a posição inicial,
seguindo o movimento em @Video1. A câmera avança lentamente enquanto as flores de cerejeira caem.
8–12 segundos: Close-up. A espada brilha, o movimento desacelera e a lâmina empurra
as pétalas que caem para os dois lados.
12–15 segundos: Retorne ao plano aberto. Ela termina a sequência, abaixa a espada
e olha em direção à câmera.
Música não diegética: N/A. Não adicione música de fundo.
Essa estrutura cria uma relação clara entre ação, movimento de câmera e som. Ela também facilita a revisão de planos individuais.
Como Escrever Prompts do MiniMax H3 para Três Modos de Geração
1. Geração com Referência Multimodal
Ao enviar referências de personagem, movimento, cena e áudio juntas, atribua uma responsabilidade clara a cada arquivo.
@Image1 é a referência de personagem. Mantenha consistentes o rosto e o figurino da heroína.
@Image2 é a referência de fundo
@Video1 é a referência de movimento. Use o movimento da dança com espada.
@Audio1 é a referência musical e emocional.
Mostre a heroína executando o movimento de referência em um castelo escuro no início da manhã.
Sincronize os cortes com as batidas principais da música.
Evite enviar uma referência sem explicar como ela deve ser usada. Um vídeo pode conter movimento, movimento de câmera, edição e som ao mesmo tempo; por isso, identifique quais elementos importam para o resultado.

|
|
2. Prompts de Imagem para Vídeo
Ao usar uma imagem, explique se ela é o primeiro quadro, uma referência de personagem ou uma referência visual geral. Ao usar duas imagens, defina a relação entre os quadros inicial e final.
@Image1 é o primeiro quadro: uma mulher está sob uma cerejeira segurando uma espada.
Anime-a desde a posição inicial até o fim da sequência de dança com espada.
Use um único plano contínuo sem cortes.
Mantenha consistentes a personagem, o figurino e a composição do pátio.
Um fluxo de trabalho com primeiro e último quadro precisa principalmente de instruções para o movimento, a iluminação e o som que conectam os dois quadros. Se quiser cortes adicionais, solicite-os explicitamente.

|
3. Prompts de Texto para Vídeo
Sem ativos de referência, descreva o sujeito, cenário, ação, estilo visual, câmera e som com mais detalhes.
15 segundos, 16:9, estilo realista de documentário sobre a natureza.
Em uma área úmida e enevoada ao amanhecer, uma garça-branca adulta fica em uma perna só em águas rasas
e vira lentamente a cabeça em direção à câmera.
Uma suave contraluz atravessa a névoa, e pequenas ondulações se movem sobre a água.
A câmera avança lentamente de um plano geral extremo para um plano médio, sem cortar.
Use apenas vento, água e cantos distantes de pássaros. Não adicione música de fundo.
Em comparação com “gere uma garça em pé na água”, esta versão define a duração, proporção, sujeito, ambiente, iluminação, movimento, direção de câmera e som.

Como Dividir os Planos?
Use Pontos de Corte em Vez de Adicionar uma Nova Ação a Cada Segundo
Os prompts do MiniMax H3 podem ser organizados em torno de planos e pontos de corte. Em cada plano, mantenha uma ação principal. Após um corte, repita o sujeito, o tamanho do plano e a relação espacial quando necessário.
Você não precisa introduzir uma ação diferente a cada segundo. Instruções excessivamente densas podem entrar em conflito e obscurecer o evento principal.
Ajuste a Duração do Diálogo à Duração do Plano
Um plano de três segundos não pode conter naturalmente uma fala longa. Leia o diálogo em voz alta e estime sua duração antes de atribuí-lo a um plano.
Para diálogos que atravessam um corte, descreva um corte J ou corte L:
- Corte J: O áudio do próximo plano começa antes do corte visual.
- Corte L: O áudio do plano anterior continua depois que a imagem muda.
Exemplo:
Plano 1: Uma voz fora de cena diz: “Acorde, acorde.”
Plano 2: Corte para um close-up de uma mulher de meia-idade. Ela é a pessoa que falou no plano anterior
e continua: “Está na hora de ir para a escola.”
Não Misture um Plano Contínuo com uma Estrutura de Vários Planos
Se solicitar um único plano contínuo, descreva o movimento dentro de um espaço contínuo. Não solicite também vários planos, cortes secos ou saltos repentinos entre locais.
Se o vídeo exigir várias cenas, remova a instrução de plano contínuo e defina cada corte claramente.
Como Controlar o Som e o Texto na Tela
Separe os Diferentes Tipos de Som
Trate o som como várias camadas distintas:
- Diálogo de personagem;
- Narração;
- Som ambiente;
- Efeitos sonoros de ação;
- Música não diegética.
Se não quiser música de fundo, escreva:
Música não diegética: N/A.
Não adicione música de fundo.
Evite pedir ao modelo para reutilizar música enquanto também solicita que não haja música de fundo. Se quiser preservar o som ambiente e remover a música, diferencie os dois.
Escreva o Texto Exato na Tela
Se o vídeo precisar de um título, logotipo, slogan ou botão, inclua a redação exata:
O título na tela do telefone diz: “Criação de Vídeo com IA.”
O texto do botão diz: “Começar Agora.”
Você também pode controlar a posição, frequência e animação:
Mostre o título uma vez no centro do quadro.
Faça-o surgir gradualmente, mantenha-o por dois segundos e não o repita.
Sempre inspecione manualmente textos, logotipos e elementos de interface gerados. Vídeos gerados por IA podem escrever incorretamente, distorcer, duplicar ou alterar esses detalhes.
Substitua Metáforas por Ações Visíveis
“A solidão sobe como a maré” expressa uma emoção, mas não define uma cena visível.
Traduza o sentimento em ações, composição, iluminação, espaço e som:
Uma pessoa está sozinha no centro de uma plataforma ferroviária vazia.
A câmera se afasta lentamente. As luzes de um trem partindo desaparecem ao longe,
deixando apenas a chuva e o eco de um anúncio da estação.
Instruções visuais concretas geralmente oferecem mais controle do que linguagem emocional abstrata.
Erros Comuns em Prompts do MiniMax H3 e Como Corrigi-los
| Erro comum | Correção recomendada |
|---|---|
| Escrever tudo em um único parágrafo grande | Separe ativos de referência, conceito central e sequência de planos |
| Enviar ativos sem definir sua finalidade | Atribua a cada arquivo um papel de personagem, movimento, cena, composição ou som |
| Incluir instruções contraditórias | Remova requisitos conflitantes de câmera, som ou estilo |
| Solicitar um plano contínuo e vários cortes | Reescreva a sequência como movimento contínuo ou remova a regra de plano contínuo |
| Esperar o mesmo rosto sem uma imagem de referência | Envie uma imagem de personagem e identifique os recursos a preservar |
| Fazer um prompt de texto para vídeo muito curto | Adicione sujeito, cenário, ação, câmera, iluminação e som |
| Usar apenas linguagem abstrata de estilo | Converta-a em cor, textura, iluminação e composição visíveis |
| Colocar diálogo demais em um plano curto | Encurte a fala ou aumente a duração do plano |
| Pedir para preservar e remover música ao mesmo tempo | Separe som ambiente, efeitos e música não diegética |
| Dar a várias referências responsabilidades sobrepostas | Defina o papel principal de cada ativo |
Modelo de Prompt do MiniMax H3 para Copiar
[INSTRUÇÕES DE ATIVOS DE REFERÊNCIA]
@Image1: Referência de personagem. Mantenha ________ consistente.
@Image2: Referência de produto/cena. Mantenha ________ consistente.
@Video1: Referência de movimento/câmera/edição. Use ________.
@Audio1: Referência de voz/música/ritmo. Use ________.
[CONCEITO CENTRAL]
Duração: ____ segundos. Proporção: ____.
O sujeito ________ realiza ________ em ________.
Use um estilo visual ________ e uma regra de câmera ________.
[SEQUÊNCIA VISUAL]
0–__ segundos: Tamanho do plano ________; visual ________; ação ________;
movimento de câmera ________; som ________.
__–__ segundos: Tamanho do plano ________; visual ________; ação ________;
movimento de câmera ________; som ________.
__–__ segundos: Tamanho do plano ________; visual ________; ação ________;
movimento de câmera ________; som ________.
[TEXTO E SOM]
Texto obrigatório na tela: “________.”
O personagem ________ diz: “________.”
Som ambiente: ________.
Música não diegética: ________.
[REQUISITOS DE CONSISTÊNCIA E EXCLUSÕES]
Mantenha ________ consistente.
Não inclua ________.
|
|
|
【DIRETRIZES DE MATERIAL DE REFERÊNCIA】
@Image 3: Estilo visual da cena — ruas / noite / espaços subterrâneos, composições claustrofóbicas, profundidade ambiental, grão de filme.
@Image 2: Tipografia e embalagem gráfica — textura de fonte, design gráfico, tipografia cinética, forte impacto de motion graphics.
@Image 1: Aparência dos personagens — rostos, penteados, silhuetas de roupas, proporções corporais, atitude e atmosfera geral.
Use como referência apenas as dimensões especificadas. Não copie diretamente as imagens de referência. Não inclua marcas, logotipos, títulos ou textos reconhecíveis do mundo real presentes nas imagens de referência originais.
【CONCEITO CENTRAL】
Um videoclipe de trap horizontal de 10 segundos, em 16:9. Dois irmãos detetives estilosos performam diretamente para a câmera, revezando-se no rap em vários locais subterrâneos apertados. Todo o vídeo se move com a batida de trap, usando cortes secos sincronizados com a batida. Tipografia em blocos de inglês, com alto contraste e estilo de pôster impresso, invade a tela a cada batida de baixo.
Estética geral: fita de videoclipe de música underground + colagem de revista de moda + qualidade editorial de alta moda, com uma performance fria e controlada da dupla de irmãos.
【DESCRIÇÃO DA SEQUÊNCIA VISUAL】
Plano 1 — Close-up Facial Extremo / Passagem Claustrofóbica
* Cenário: Corredor apertado ou entrada subterrânea, filmado de perto, com referência a @Image 3.
* Enquadramento: Close-up extremo do rosto — rosto / olhos / pescoço e ombros / detalhes parciais da gola.
* Personagem: Detetive A olha diretamente para a câmera e começa a rimar, com uma expressão calma, mas afiada como uma lâmina.
* Tipografia: Texto enorme e em negrito em inglês, “TWO FLY”, surge na parte superior e inferior do quadro sem cobrir os olhos.
* Ritmo: Na batida de baixo 808, “TWO FLY” é instantaneamente comprimido verticalmente e depois retorna bruscamente. Durante os rolls de hi-hat, as bordas das letras vibram rapidamente com um movimento fino e fragmentado. Na palavra acentuada “fly”, acione um deslocamento/glitch de linhas de varredura.
* Corte seco.
Plano 2 — Close-up Médio / Fundo de Parede Tipográfica
* Cenário: Uma parede diferente ou parede coberta de pôsteres vista de perto, visualmente distinta do Plano 1.
* Enquadramento: Afaste-se claramente para uma composição de close-up médio / meio corpo.
* Personagem: Detetive B rima diretamente para a câmera. Seus ombros e cabeça acompanham o ritmo do hi-hat, com o corpo levemente inclinado para frente.
* Tipografia: Texto enorme e condensado em inglês, “CLUES”, fica atrás do personagem, naturalmente ocultado pelo cabelo, ombros e silhueta das roupas.
* Ritmo: A tipografia se estica verticalmente como se um pôster estivesse se erguendo. Em cada caixa, o texto aumenta subitamente, treme e se desloca com distorção de linhas de varredura.
* Corte seco.
Plano 3 — Close-up das Mãos / Transição por Oclusão
* Cenário: Borda de uma porta de metal / corrimão / parede de garagem / trecho de teto baixo.
* Enquadramento: Close-up focado nas mãos, anéis, punhos e texturas das roupas.
* Personagem: Detetive A faz um gesto com a mão em direção à câmera, como se estivesse passando uma pista. Seu rosto permanece desfocado ou parcialmente visível ao fundo.
* Tipografia: “BROTHERS” vertical aparece em um lado do primeiro plano e é brevemente ocultado pela mão.
* Ritmo: Na frase “move as one”, a tipografia se estica em uma longa faixa vertical, depois sofre um corte seco e se reconstrói com a batida de baixo.
* Corte seco.
Plano 4 — Close-up de Ombro/Pescoço para Close-up Facial / Canto de Escadaria
* Cenário: Canto de escadaria / porta sombreada / passagem baixa.
* Enquadramento: Comece com um close-up do ombro, pescoço, gola e textura das roupas → avance subitamente para um close-up facial na caixa.
* Personagem: Detetive B vira a cabeça e se aproxima da câmera enquanto continua rimando.
* Tipografia: “AS ONE” explode como uma manchete de revista de moda, aumentando subitamente de escala na batida.
* Ritmo: Durante a aproximação, a tipografia muda abruptamente com corte seco para um novo layout. Ela nunca deve cobrir os olhos.
* Corte seco.
Plano 5 — Close-up de Meio Corpo com Eco de Movimento / Fundo de Garagem ou Concreto
* Cenário: Espaço semelhante a uma garagem ou fundo de concreto.
* Enquadramento: Close-up de meio corpo do Detetive A.
* Personagem: A camada principal tem movimento labial claro e sincronizado com precisão. Uma camada secundária cria um eco dinâmico de movimento — deslocamento estilo fotocopiadora / atraso de quadro — mantendo o rosto estruturalmente intacto e sem distorção. Seu gesto de mão varre horizontalmente diante da lente.
* Tipografia: “CUT GOLD” vertical pisca ao fundo com animação de quadros descartados.
* Ritmo: Em “CUT”, o quadro é instantaneamente cortado horizontalmente, acionando um corte seco com flash branco. “GOLD” se comprime em um bloco pesado de tipografia e depois salta de volta subitamente.
* Corte seco.
Plano 6 — Tela Dividida em Close-up de Duas Pessoas / Segmentação por Blocos de Cor
* Cenário: Entrada subterrânea / parede / corrimão / batente de porta, visualmente distinto do Plano 5.
* Enquadramento: A imagem é dividida em duas ou três seções de blocos de cor. Cortes secos rápidos alternam entre close-ups dos rostos dos dois detetives e detalhes recortados de meio corpo.
* Personagem: Os dois detetives performam alternadamente nos lados esquerdo e direito.
* Tipografia: Surge um texto central em negrito: “CASE COMPLETE.”
* Ritmo: A composição se reconstrói por meio de cortes secos a cada batida de baixo 808. As letras primeiro achatam e depois se esticam instantaneamente. Durante os rolls de hi-hat, fragmentos tipográficos saltam rapidamente. No acento final, acione deslocamento de varredura combinado com vibração em estilo papel rasgado.
* Corte seco.
Final — Montagem de Performance em Close-up em Vários Locais
* Cenários: Alternância rápida entre um close-up facial em um corredor estreito, close-up médio contra uma parede, close-up das mãos, close-up de ombro/pescoço em um canto de escadaria, plano recortado de meio corpo em um ambiente de garagem e close-up de duas pessoas em uma porta sombreada.
* Enquadramento: Sem planos de corpo inteiro e sem planos abertos de grupo. Use apenas close-ups, close-ups médios, close-ups faciais, close-ups das mãos, close-ups de ombro/pescoço e planos de meio corpo.
* Personagens: Os dois detetives se alternam rimando diretamente para a câmera. Movimento labial, movimento da mandíbula, respiração, sobrancelhas/olhos e gestos com as mãos devem sincronizar com precisão com os vocais, caixas, rolls de hi-hat e batidas de baixo.
* Tipografia: Texto final de destaque, “CASE CLOSED”, invade massivamente o quadro.
* Ritmo: Cada batida de baixo aciona um corte seco de local ou uma mudança abrupta de enquadramento. Cada caixa aciona um impacto tipográfico ou deslocamento de camada. Na batida final, todos os fragmentos das diferentes cenas congelam simultaneamente, seguidos por um corte seco para preto.
【REQUISITOS GERAIS ADICIONAIS】
▍ESTILO VISUAL — EM TODO O VÍDEO
* Grão intenso, leve oscilação de filme, textura de papel fotocopiado, pontos de meio-tom, bordas impressas ásperas, deslocamento de varredura, ecos de movimento com quadros descartados e desalinhamento de camadas em alta velocidade.
* Edição extremamente rápida. Use apenas cortes secos, jump cuts, cortes na batida, cortes por oclusão, cortes secos com flash branco e cortes secos conduzidos pela tipografia.
* Sem fades, sem dissoluções e sem transições suaves.
▍TIPOGRAFIA / EMBALAGEM GRÁFICA — EM TODO O VÍDEO
* A tipografia deve funcionar como uma parte integrada da imagem, com camadas espaciais verossímeis.
* O texto pode existir no primeiro plano, plano médio ou fundo em relação aos personagens.
* Os personagens podem ocultar a tipografia, e a tipografia pode sobrepor partes dos personagens, mas nunca deve cobrir os olhos ou expressões faciais importantes.
* A tipografia deve reagir a acentos vocais, caixas, rolls de hi-hat e batidas de baixo 808 por meio de aparição, vibração, estiramento, compressão, deslocamento, rasgo e reconstrução por corte seco.
* Estilo: Sans-serif pesada e condensada, letras enormes em bloco em inglês, estiramento vertical, compressão horizontal, texto em inglês disposto verticalmente, manchetes curvas, alto contraste em preto / branco / vermelho, grão de papel fotocopiado, pontos de meio-tom, impressão desgastada, deslocamento de varredura e estética de colagem zine.
* Mantenha a quantidade de tipografia contida: apenas um elemento de texto principal por plano, com no máximo uma pequena quantidade de numeração. Sem texto pequeno denso e sem logotipos.
▍REGRAS DE RITMO — EM TODO O VÍDEO
* Roll de hi-hat → microvibrações rápidas, quadros descartados, reconstrução tipográfica fragmentada.
* Caixa → a tipografia aumenta subitamente, o quadro recebe corte seco, os ombros do personagem fazem um movimento para baixo.
* Batida de baixo 808 → compressão de tela em baixa frequência, breve deformação da imagem, tipografia se estica verticalmente ou se comprime horizontalmente.
* Palavras-chave vocais → movimento labial sincronizado, movimento de mandíbula, acenos de cabeça e gestos de mão para frente.
* Movimento dos personagens, animação tipográfica, mudanças de local e mudanças de enquadramento devem acompanhar a batida juntos.
▍MUDANÇAS DE LOCAL — EM TODO O VÍDEO
* Cortes secos rápidos entre vários ambientes vistos de perto.
* Todos os locais devem manter a atmosfera geral de @Image 3, enquanto cada plano deve usar um espaço claramente distinto: corredor estreito, parede próxima, porta sombreada, fundo de metal/concreto, iluminação de borda, parede de pôsteres, canto de escadaria, teto baixo, espaço semelhante a garagem, entrada subterrânea.
* Sem grandes planos de estabelecimento ou cenas complexas de grande escala.
* Cada mudança de local deve ser acionada por uma batida de baixo, caixa, acento vocal ou impacto tipográfico.
▍MUDANÇAS DE ESCALA DE PLANO — EM TODO O VÍDEO
* As mudanças de escala de plano devem ser muito perceptíveis: close-up facial extremo → close-up médio / meio corpo → close-up das mãos → close-up de ombro/pescoço → tela dividida em close-up de duas pessoas → close-up facial → plano recortado de meio corpo.
* Não use a mesma escala de plano consecutivamente.
* Cada corte seco deve criar uma mudança óbvia na distância da câmera, orientação do personagem, espaço de fundo e profundidade/camadas da tipografia.
* O movimento de câmera pode incluir leve movimento de câmera na mão, aproximações repentinas, movimentos laterais curtos, zooms rápidos de compressão e balanço em curta distância.
* Não transforme a sequência em cinematografia suave ou em câmera lenta.
▍REGRAS DE PERSONAGEM — EM TODO O VÍDEO
* Personagens: Dois detetives estilosos / irmãos.
* Preserve os rostos, penteados, silhuetas das roupas, proporções, atitude e atmosfera geral dos personagens em @Image 1.
* A pele deve parecer realista e fosca, limpa e premium, com poros naturais e textura sutil de pele.
* Sem rostos brilhantes ou excessivamente suavizados por filtros de beleza de IA.
* Os dois irmãos se revezam rimando diretamente para a câmera com forte energia de performance.
▍PERFORMANCE DOS PERSONAGENS — EM TODO O VÍDEO
* Entrega vocal: fria, agressiva, relaxada porém intimidadora, com um flow rítmico firme, fragmentado e fortemente acentuado.
* Isto não é pose estática — eles estão performando ativamente.
* Sincronização labial clara: lábios, mandíbula, expressões faciais e respiração devem acompanhar os vocais.
* Movimentos sincronizados com a batida: acenos de cabeça, quedas de ombro, gestos de mão para frente, inclinar-se para frente, virar a cabeça, girar o corpo, aproximar-se da câmera e apontar os dedos diretamente para a lente.
▍RESTRIÇÕES IMPORTANTES — EM TODO O VÍDEO
* Sem planos de corpo inteiro.
* Sem planos abertos de grupo.
* Sem cenas complexas de multidão ou elenco.
* Use apenas close-ups, close-ups médios, close-ups faciais, close-ups das mãos, close-ups de ombro/pescoço e planos de meio corpo durante todo o vídeo.
* Mostre apenas as partes superiores dos corpos dos personagens, rostos, gestos, texturas das roupas, expressões, sincronização labial e tipografia/embalagem gráfica.
* Não é necessário mostrar corpos completos ou pés.
* Não inclua marcas, logotipos, títulos ou textos originais reconhecíveis do mundo real de qualquer imagem de referência.
Conclusão
Escrever um prompt para o MiniMax H3 significa transformar uma ideia criativa em um briefing de produção claro.
Primeiro, defina o papel de cada ativo de referência. Em seguida, resuma o vídeo em uma frase focada. Por fim, descreva os planos, movimento, som, texto e restrições em uma sequência lógica. Um prompt conciso com uma estrutura forte costuma ser mais fácil de testar e revisar do que uma longa lista de adjetivos.
Você pode aplicar este modelo na página da ferramenta MiniMax H3 no WeShop AI ou começar pelo espaço de trabalho principal do WeShop AI. Verifique a interface atual antes de definir duração, resolução ou requisitos de arquivos de referência, pois as opções disponíveis podem mudar.