Danse IA MiniMax H3 (Hailuo) : créez une vidéo de danse à deux personnes à partir d’une vidéo de référence et d’images de personnages
Découvrez comment utiliser MiniMax H3 avec un clip de danse de référence et deux images de personnages pour générer une vidéo de danse IA à deux personnes, à caméra fixe et chorégraphie guidée.
Une danseuse commence près de la caméra, ouvre ses mains comme un éventail pliant, puis recule lorsqu’un second personnage rejoint la chorégraphie derrière elle. Les mouvements, l’espacement et le cadrage proviennent d’un clip de danse existant, mais les danseurs eux-mêmes peuvent être remplacés par vos propres designs de personnages.
Ce workflow de danse IA MiniMax H3 montre comment combiner une vidéo de référence, deux images de référence de personnages et un prompt structuré afin de créer une courte vidéo de danse à deux personnes tout en conservant la chorégraphie originale comme guide de mouvement.
À qui s’adresse ce workflow de danse IA MiniMax H3
Ce workflow est utile si vous souhaitez :
- créer des vidéos de danse IA ou de personnages dansants ;
- recréer la structure des mouvements d’un clip de référence avec différents personnages ;
- combiner une vidéo de référence et des éléments de design de personnages dans un même workflow MiniMax H3 ;
- produire du contenu court avec des personnages pour les réseaux sociaux.
L’objectif n’est pas de demander au modèle d’inventer une danse aléatoire. Le clip de référence fournit au contraire une chorégraphie et une composition concrètes à suivre.
Ce que vous allez créer
Le résultat visé est une courte vidéo verticale de danse à deux personnes présentant quatre caractéristiques claires :
- la chorégraphie, le tempo, le cadrage et l’espacement des danseurs suivent la vidéo de référence fournie ;
- la danseuse principale utilise un design de personnage Lolita rouge et blanc personnalisé ;
- le danseur secondaire utilise une référence de personnage masculin distincte ;
- la scène reste dans un seul plan vertical continu à caméra fixe.
Cette répartition des rôles est importante : la vidéo définit comment les personnages bougent, tandis que les références de personnages définissent qui apparaît dans la scène.
Préparez trois types d’entrées
1. Vidéo de danse de référence
La vidéo de référence fournit la structure des mouvements pour la génération.
Dans cet exemple, le clip d’environ 13 secondes peut être compris en quatre étapes :
- Gros plan d’ouverture : la danseuse principale commence près de la caméra et effectue des gestes délicats avec les mains autour de son visage.
- Révélation en reculant : elle recule jusqu’à ce que les deux danseurs soient clairement visibles.
- Chorégraphie synchronisée : les deux personnages exécutent des croisements de poignets coordonnés, des gestes d’ouverture des mains, des poussées latérales, des rotations de poignets et des mouvements de bras.
- Pose finale : les deux danseurs font face à l’avant et terminent dans une position maîtrisée.
Au lieu de décrire la danse uniquement comme un style tel que « chorégraphie mignonne », identifiez les mouvements et leur séquence. Cela donne au modèle des informations plus concrètes à suivre.

Le clip de référence établit la chorégraphie, l’espacement des danseurs et la composition à caméra fixe.
2. Référence du personnage principal
La première image de personnage contrôle l’identité visuelle de la danseuse principale.
Dans cet exemple, les caractéristiques reconnaissables les plus importantes sont :
- deux tresses noires ;
- une grande coiffe à nœud rouge et blanc ;
- une robe Lolita rouge et blanche à pois, composée de plusieurs couches ;
- des détails en dentelle et en nœuds ;
- des accessoires blancs aux poignets ;
- des chaussures rouges.
Une planche de personnage multi-vues est particulièrement utile ici, car la tenue contient de nombreux détails qui doivent rester visuellement cohérents pendant les mouvements du personnage.

La référence du personnage principal définit la coiffure, la tenue, les proportions et les détails visuels reconnaissables de la danseuse.
3. Référence du danseur secondaire
La seconde image de référence contrôle l’apparence du danseur secondaire.
Pour une vidéo de danse IA à deux personnes, il est préférable que les deux références de personnages soient visuellement distinctes. Dans ce cas, le personnage secondaire possède une silhouette violette marquée qui le distingue clairement de la danseuse principale rouge et blanche.
Le prompt peut alors se concentrer sur son rôle dans la chorégraphie :
- se tenir légèrement derrière la danseuse principale ;
- rester sur le côté gauche de la composition ;
- reproduire la chorégraphie en miroir ;
- bouger avec assurance sans prendre la position principale.

La seconde référence de personnage donne au danseur secondaire une identité distincte et reconnaissable.
Configurez les éléments de référence dans MiniMax H3
Pour ce workflow, attribuez une fonction précise à chaque entrée au lieu de forcer toutes les instructions dans le prompt.
Utilisez :
- Vidéo de référence : le clip de danse ;
- Référence de design de personnage : l’image de la danseuse principale et l’image du danseur secondaire ;
- Prompt : la scène, les rôles des personnages, la séquence d’actions, le comportement de la caméra et les contraintes de qualité.
Un modèle mental utile est :
- vidéo de référence = comment ils bougent
- images de personnages = qui ils sont
- prompt = où cela se déroule et ce qui doit rester cohérent

Joignez le clip de danse comme vidéo de référence et les deux planches de personnages comme références de design de personnage avant de générer.
Utilisez un prompt structuré pour la vidéo de danse IA
Un prompt vague tel que « faites danser ces deux personnages ensemble » laisse trop de décisions ouvertes.
Pour un meilleur contrôle, divisez l’instruction en cinq parties :
- tâche globale ;
- scène et caméra ;
- personnage principal ;
- séquence chorégraphique ;
- contraintes de cohérence et d’anatomie.
Utilisez le prompt suivant comme point de départ :
Vidéo de référence:@{video1}
Référence de design de personnage:@{image1} @{image2}
Créez une vidéo de danse verticale de 13 secondes qui reproduit, temps par temps, la chorégraphie, le tempo, le cadrage et l’espacement des danseurs de la vidéo de référence @{video1}.
La référence de personnage @{image1} doit contrôler le visage, la coiffure, les proportions du corps et la tenue Lolita douce rouge et blanche de la danseuse principale.
Utilisez un seul plan continu à caméra fixe de smartphone dans un appartement moderne spacieux aux murs beige chaud, au plafond blanc, avec éclairage encastré, mobilier sombre et sol poli. Utilisez un éclairage intérieur naturel avec une qualité réaliste de vidéo de danse pour réseaux sociaux. Aucun cut ni transition.
La danseuse principale @{image1} commence près de la caméra, légèrement à droite du centre, vêtue d’une robe Lolita rouge et blanche à pois composée de plusieurs couches, avec beaucoup de dentelle et de nœuds, une grande coiffe assortie, deux tresses noires, des manchettes blanches aux poignets et des chaussures rouges. Un danseur secondaire masculin @{image2} se tient un pas derrière elle, sur la gauche.
Elle commence par des gestes délicats et légers avec les mains près de son visage, joint les paumes puis ouvre les doigts comme un éventail pliant. Elle recule ensuite jusqu’à ce que les deux danseurs soient visibles de la tête jusqu’en dessous des genoux.
Ils exécutent la même chorégraphie synchronisée des mains : croisez les deux poignets en formant un « X », déployez les paumes vers l’extérieur comme un éventail qui s’ouvre, poussez alternativement les paumes ouvertes à gauche et à droite, faites tourner les poignets en cercles fluides, faites rouler les deux avant-bras sur la poitrine et balayez les mains vers le bas jusqu’à la taille.
Répétez le geste de croisement et d’ouverture en éventail tout en transférant le poids du corps d’un côté à l’autre par de petits pas et de doux balancements des hanches.
Le danseur masculin reproduit la chorégraphie en miroir, légèrement derrière la danseuse principale, avec des mouvements assurés et maîtrisés. La danseuse principale garde une expression mignonne et vive, regarde vers la caméra, tandis que sa jupe à plusieurs couches rebondit et se balance naturellement.
Terminez avec les deux danseurs face à l’avant, un bras courbé sur la poitrine et l’autre abaissé près de la taille.
Utilisez des mouvements fluides en temps réel, des mouvements de mains synchronisés et précis, des visages cohérents et une physique crédible de la robe. Aucun mouvement de caméra à main levée, changement de costume, doigts dupliqués, membres supplémentaires ou corps déformés.
Pourquoi ce prompt de référence MiniMax H3 fonctionne
1. Définissez ce que la vidéo de référence doit contrôler
La première phrase identifie quatre propriétés précises :
- la chorégraphie ;
- le tempo ;
- le cadrage ;
- l’espacement des danseurs.
C’est bien plus clair que de simplement dire « suivez cette vidéo ». Cela indique à la génération quelles parties de la référence sont importantes à préserver.
2. Donnez un rôle clair à chaque référence de personnage
La danseuse principale est explicitement associée à @{image1}, notamment pour son visage, sa coiffure, ses proportions et sa tenue.
Le danseur secondaire est associé à @{image2} et reçoit une position physique ainsi qu’un rôle chorégraphique différents.
Cela réduit l’ambiguïté entre les deux références de personnages.
3. Verrouillez la caméra avant de décrire la danse
Le prompt précise :
- un seul plan continu ;
- un cadrage de smartphone à caméra fixe ;
- aucun cut ;
- aucune transition.
Ces contraintes maintiennent l’attention sur la chorégraphie au lieu d’introduire des changements de caméra inutiles.
4. Décrivez les actions dans l’ordre
Des instructions de mouvement concrètes sont plus utiles que des descriptions abstraites.
Par exemple :
- croisez les deux poignets en formant un « X » ;
- ouvrez les paumes vers l’extérieur ;
- poussez alternativement les paumes à gauche et à droite ;
- faites tourner les poignets ;
- faites rouler les avant-bras sur la poitrine ;
- balayez les mains vers la taille.
Cela donne au modèle une trajectoire de mouvement ordonnée à suivre, tandis que la vidéo de référence fournit le rythme.
Générez la vidéo et examinez le résultat
Une fois la vidéo de référence, les deux images de personnages et le prompt en place, générez le clip et comparez le résultat avec la référence originale.
Vous pouvez l’essayer directement à l’aide de l’outil situé à droite.
Examinez ces cinq aspects avant de décider si la génération est prête.
1. Vérifiez le positionnement des deux danseurs
La composition souhaitée est la suivante :
- la danseuse principale commence plus près de la caméra et légèrement à droite du centre ;
- le danseur secondaire commence un pas derrière elle sur la gauche ;
- les deux danseurs restent visibles après que la danseuse principale a reculé.
Si le danseur secondaire disparaît ou se place du mauvais côté, renforcez les instructions spatiales au lieu de réécrire l’intégralité du prompt.
2. Inspectez la chorégraphie des mains
Les vidéos de danse riches en mouvements de mains sont particulièrement sensibles aux erreurs visuelles.
Recherchez :
- des doigts fusionnés ou dupliqués ;
- des poignets déformés ;
- des gestes de croisement et d’ouverture incomplets ;
- des mouvements gauche-droite incohérents ;
- des erreurs de synchronisation entre les deux danseurs.
Concentrez-vous d’abord sur les mouvements qui définissent la chorégraphie plutôt que sur les différences mineures qui n’affectent pas l’ensemble de la danse.
3. Vérifiez la cohérence du visage et de la coiffure
Pour la danseuse principale, vérifiez que la vidéo générée conserve la même identité reconnaissable tout au long du clip.
Portez attention à :
- la cohérence du visage ;
- les deux tresses noires ;
- la grande coiffe à nœud ;
- la stabilité des cheveux et des accessoires pendant les mouvements du personnage.
4. Inspectez la tenue Lolita en mouvement
La robe à plusieurs couches représente un autre défi de cohérence, car elle contient de nombreux éléments superposés.
Vérifiez que le résultat conserve :
- l’identité de couleurs rouge et blanc ;
- le grand nœud de tête ;
- la forme de la jupe à plusieurs couches ;
- les détails visibles de dentelle et de nœuds ;
- un mouvement de jupe plausible pendant les pas et les déplacements des hanches.
L’objectif n’est pas une perfection image par image, mais un costume qui reste reconnaissable et physiquement crédible pendant toute la danse.
5. Vérifiez la pose finale
Le clip doit se terminer de façon intentionnelle plutôt que de simplement manquer de temps.
Les deux danseurs doivent :
- faire face à la caméra ;
- se stabiliser dans la position finale prévue ;
- terminer proprement le mouvement des bras ;
- rester visuellement stables à la fin du plan.
| Chorégraphie de référence | Résultat MiniMax H3 |
|---|---|
![]() | ![]() |
| Mouvement de référence et espacement des danseurs. | Personnages générés suivant la même structure de danse. |
Que modifier si la première génération est instable
Si le premier résultat nécessite une nouvelle tentative, modifiez une catégorie à la fois.
Correction 1 : La danse est similaire, mais la chorégraphie est incorrecte
Renforcez la séquence d’actions.
Au lieu d’ajouter davantage de descriptions esthétiques, identifiez les gestes précis qui manquent ou qui se produisent dans le mauvais ordre.
Correction 2 : Les deux personnages sont confondus
Renforcez l’attribution des références :
@{image1}contrôle la danseuse principale ;@{image2}contrôle le danseur secondaire ;- le danseur secondaire reste derrière la danseuse principale ;
- le danseur secondaire reproduit la chorégraphie en miroir sans prendre la position principale.
Correction 3 : La caméra commence à bouger
Répétez les restrictions de caméra :
un seul plan continu
plan de smartphone à caméra fixe
aucun cut ni transition
Cela maintient la composition plus proche d’un enregistrement de danse pour réseaux sociaux que d’une séquence à plusieurs plans.
Correction 4 : Les mains ou les corps deviennent déformés
Gardez des contraintes négatives concises à la fin du prompt :
Aucun doigt dupliqué, membre supplémentaire, corps déformé ou changement de costume.
Ces instructions ne peuvent pas garantir une anatomie parfaite, mais elles rendent explicite le niveau de qualité attendu.
Transformez une danse de référence en performance de vos propres personnages
La plus grande force de ce workflow de danse IA MiniMax H3 réside dans la répartition du contrôle : la vidéo de référence fournit la chorégraphie, les planches de personnages fournissent les identités visuelles et le prompt les relie dans une scène contrôlée.
Une fois cette relation claire, vous pouvez réutiliser la même structure avec différentes paires de personnages, différents costumes et concepts de danse courte sans recréer la chorégraphie depuis zéro. Essayez le workflow MiniMax H3 sur WeShop et commencez avec un court clip de référence avant de passer à des scènes plus complexes.








