- Blog
- MiniMax H3 génère toujours le même visage : comment obtenir des personnages distincts
MiniMax H3 génère toujours le même visage : comment obtenir des personnages distincts

AI Overview
Pourquoi MiniMax H3 génère-t-il systématiquement le même visage ?
Des invites de personnage trop larges peuvent aboutir à un visage familier, même avec une graine différente. Le modèle doit encore inventer une identité : une formulation vague laisse donc trop d’éléments de cette décision non contraints.
Une graine aléatoire produit-elle toujours une personne différente ?
Non. Une nouvelle graine modifie l’échantillon, mais ne garantit pas une structure faciale différente. Si l’invite décrit le même rôle générique, plusieurs résultats peuvent encore ressembler à des proches parents.
Dois-je utiliser une image de référence pour augmenter la diversité des visages ?
Utilisez des références uniquement après avoir choisi l’identité que vous souhaitez conserver. Pour obtenir initialement une diversité de casting, des lots textuels uniquement, avec des variables d’identité contrôlées, facilitent la comparaison de candidats réellement différents.
Comment savoir si deux visages générés sont trop similaires ?
Comparez plutôt les traits stables que les cheveux ou la tenue : forme du visage, sourcils, espacement des yeux, arête du nez, mâchoire, indices d’âge et texture de la peau. Examinez d’abord des vues frontales neutres avant d’évaluer des séquences animées.
Ce que signifie réellement « le même visage »
Lorsque MiniMax H3 génère systématiquement le même visage, l’échec n’est généralement pas un doublon pixel pour pixel. Il s’agit d’un schéma de casting répété : âge similaire, visage ovale symétrique, mâchoire étroite, espacement des yeux familier, peau lisse et expression éditoriale identique. Les cheveux, les vêtements et le lieu peuvent varier suffisamment pour masquer initialement cette répétition. Dès lors que les séquences sont placées côte à côte, les personnages donnent l’impression d’être apparentés ou interchangeables.
Cela correspond à une intention de recherche différente de celle consistant à maintenir la cohérence d’un personnage choisi. La cohérence demande à H3 de préserver l’identité d’un personnage à travers les plans. La diversité des visages, quant à elle, exige que la génération texte-vers-vidéo invente dès la phase de casting des identités clairement distinctes. Ne résolvez pas ce second problème en ajoutant une image de référence aléatoire : cela verrouille simplement une autre identité avant même que vous ne sachiez si elle convient.

Image conceptuelle éditoriale : des cheveux et des vêtements différents peuvent masquer le fait que les sourcils, l’espacement des yeux, le nez et la mâchoire se répètent.
Distinction entre répétition d’identité et continuité ordinaire
Déterminez d’abord ce qui se répète. Si le même visage apparaît dans plusieurs générations textuelles non liées, vous êtes confronté à un problème de diversité. Si un même visage change à l’intérieur d’une seule séquence, il s’agit d’une dérive d’identité. Si deux personnes nommées se confondent pendant une interaction, il s’agit d’un échec de liaison des sujets ou d’occlusion. Chacun nécessite une solution différente.
Le système officiel H3 distingue clairement la génération textuelle uniquement de FL2VA et la génération multimodale de Ref2VA comme deux familles de tâches différentes. Cette distinction est essentielle : la génération textuelle uniquement crée la personne à partir du langage, tandis que la génération par référence peut hériter d’une identité visuelle sélectionnée. La documentation du modèle ne garantit pas que des graines différentes produiront un panel de casting équilibré ; considérez donc la diversité comme un aspect à tester et à orienter activement.
Vérifiez si l’invite demande secrètement un seul archétype
Des invites telles que « belle jeune femme », « bel homme cinématographique » ou « créateur stylé » décrivent un rôle et une esthétique, non un individu. Répéter le même rôle, la même focale, la même lumière de beauté et la même ambiance peut continuer à orienter les générations vers le même centre visuel. Des mots supplémentaires qualitatifs n’ajoutent aucune information sur l’identité.
Vérifiez également les invites négatives. Supprimer les rides, l’asymétrie, la texture de la peau, les lignes capillaires inhabituelles ou les indices marqués d’âge peut effacer précisément les traits qui différencient les candidats.
Construire un test rigoureux de diversité
Ne diagnostiquez pas ce phénomène à partir de deux vignettes attrayantes. Créez un petit test de casting qui sépare l’identité faciale du style de la scène. Générez six courtes séquences neutres avec la même durée, fréquence d’images, rapport hauteur/largeur, position de caméra, catégorie de tenue, arrière-plan et éclairage. Ne modifiez que la description de l’identité et la politique de graine. Un gros plan moyen statique avec une légère rotation de la tête suffit ; une action spectaculaire rend la comparaison plus difficile.

Image conceptuelle éditoriale : un éclairage, un cadrage et une tenue identiques rendent les différences faciales plus faciles à juger.
Utilisez une matrice de casting à six candidats
Attribuez à chaque candidat un profil délibérément différent. Faites varier plusieurs traits stables simultanément, plutôt que de modifier uniquement la couleur des cheveux.
| Candidat | Variables d’identité à modifier | À maintenir constants |
|---|---|---|
| A | adulte âgé, mâchoire carrée, cheveux courts et argentés | caméra, éclairage, action |
| B | jeune adulte, visage rond, sourcils doux, boucles serrées | caméra, éclairage, action |
| C | adulte d’âge moyen, visage allongé, arête nasale saillante | caméra, éclairage, action |
| D | jeune adulte, pommettes larges, crâne rasé | caméra, éclairage, action |
| E | adulte âgé, visage étroit, sillons profonds du sourire | caméra, éclairage, action |
| F | adulte d’âge moyen, visage en forme de cœur, cheveux ondulés | caméra, éclairage, action |
Utilisez descripteurs respectueux et objectivement observables, et évitez de supposer des caractéristiques protégées. Cette matrice de production illustre simplement si les modifications apportées à l’invite atteignent effectivement le visage rendu.
Enregistrez une image neutre de comparaison
Exportez une image frontale ou en trois quarts prise au même instant dans chaque extrait. Recadrez chaque image de façon à obtenir une taille identique pour la tête, puis procédez à l’évaluation sans afficher les noms de fichiers. Notez, sur une échelle de 0 à 2, la forme du visage, les sourcils, les yeux, le nez, la mâchoire et les indices d’âge : zéro signifie « clairement différent », un signifie « partiellement similaire », et deux signifie « fortement similaire ». Deux candidats partageant quatre caractéristiques ou plus ne doivent pas tous deux être retenus dans un jeu de casting pour une campagne, sauf si cette ressemblance est intentionnelle.
Conservez également les extraits vidéo intégraux. Une image fixe peut sembler distincte, tandis que le mouvement fait glisser l’expression faciale vers une apparence familière. Avant validation, examinez la première, la deuxième et la dernière seconde de chaque extrait.
Réécrivez la consigne pour définir une personne différente
La solution la plus rapide n’est pas une consigne plus longue. Remplacez les formulations floues relatives à l’attractivité par un bloc d’identité concis, et laissez le reste de la consigne décrire uniquement l’action. Le générateur MiniMax H3 vous offre un environnement hébergé pour exécuter ce test contrôlé identique, sans avoir à reconstruire localement un graphe.
Utilisez un seul bloc d’identité et un seul bloc de prise de vue
Copiez cette structure et modifiez uniquement la ligne d’identité entre les candidats :
Identité : un artiste céramiste fictif d’âge moyen, au visage allongé et anguleux, aux sourcils marqués, au nez doté d’un dos proéminent, aux courts cheveux bouclés poivre-et-sel, à la peau texturée naturelle et à l’expression calme, sans sourire. Cette personne ne doit pas ressembler aux candidats précédents.
Prise de vue : gros plan moyen dans un studio neutre éclairé en lumière du jour. Le sujet regarde vers la caméra, tourne légèrement la tête vers la gauche, puis reste immobile. Cadrage statique dans le style d’un objectif 50 mm, éclairage latéral doux, pull en tricot de charbon de bois uni, aucun retouchage beauté, aucune mention textuelle ni aucun logo. Seul le bruit ambiant d’une pièce silencieuse.
L’instruction « ne doit pas ressembler aux candidats précédents » est utile comme intention, mais ne permet pas de comparaison avec des images que le modèle n’a jamais reçues. Ce sont les traits concrets qui font réellement la différence. Conservez identiques l’action, le langage cinématographique et l’éclairage afin de pouvoir déterminer si la ligne d’identité a effectivement modifié la personne représentée.

Image conceptuelle éditoriale : modifiez la définition de l’interprète tout en maintenant constant le dispositif de production.
Supprimez les conflits internes à la consigne
Une consigne peut demander un visage âgé, puis annuler cette demande avec des termes comme « jeune », « impeccable », « peau lisse » ou « publicité beauté ». Elle peut exiger une mâchoire large, puis introduire une référence dont le sujet présente une mâchoire étroite. Résolvez ces conflits avant d’investir davantage de graines (seeds).
Une seule action principale et un seul mouvement de caméra suffisent pour le casting. Une fois un candidat approuvé, rétablissez le décor réel, la tenue, l’interprétation et le plan de tournage prévu. Le guide Ref2VA versus FL2VA explique quand le texte ou les images-clés doivent inventer la prise de vue, et quand les références doivent prendre le contrôle.
Utilisez les graines (seeds) et les références de façon réfléchie
Une graine (seed) est un outil de reproductibilité, non une instruction de casting. Modifiez-la pour explorer une consigne, mais ne supposez pas qu’un nouvel entier implique automatiquement une nouvelle identité. Enregistrez la consigne, la famille de tâches, le point de contrôle (checkpoint), la graine, la durée et la version du flux de travail, afin qu’un candidat pertinent puisse être reproduit fidèlement.
Générez d’abord un lot, puis verrouillez le gagnant
Générez d’abord un lot contrôlé de six candidats, sans recourir à des références d’identité. Sélectionnez un candidat sur la base de l’adéquation faciale, de la stabilité du mouvement et de la pertinence pour le rôle — et non simplement sur la beauté du premier cadre. Ensuite, enregistrez un portrait neutre ainsi qu’une image utile en pied ou en trois quarts comme « pack d’identité approuvé ».
Passez uniquement à Ref2VA après approbation. Attribuez à chaque référence visuelle une fonction claire : l’une pour le visage, l’autre pour le corps ou la tenue, et éventuellement une troisième pour l’environnement. Le flux de travail de remplacement de personnage montre comment conserver un interprète choisi tout en préservant le mouvement et la mise en scène d’un plan existant.
Sortie MiniMax H3 Ref2VA documentée : utilisez le mode référence après le casting pour vérifier si l’identité sélectionnée résiste au mouvement, aux changements de caméra et à l’audio pris ensemble.
Ne mélangez pas casting et continuité dans un même lot
Si chaque candidat utilise la même référence portrait, des visages identiques sont attendus. Une référence de mouvement montrant clairement un interprète peut influencer davantage le résultat que le mouvement lui-même, à moins que son rôle ne soit explicitement défini. Testez séparément l’invention de personnages, puis combinez les entrées approuvées.
Pour les scènes impliquant deux personnes, étiquetez-les clairement et distinguez nettement leurs rôles physiques. Le flux de travail vidéo MiniMax H3 à deux personnes couvre les identifiants des sujets, les regards croisés (eyelines) et le tour de parole, afin qu’une identité ne « déborde » pas sur l’autre.
Diagnostiquez les ressemblances persistantes
Si des blocs d’identité détaillés produisent encore des ressemblances, identifiez la première étape où celles-ci apparaissent. Comparez le résultat de base en 768p avant toute régénération, mise à l’échelle, amélioration faciale ou interpolation. Les opérations de restauration peuvent normaliser la peau et les détails du visage de façon si agressive que des entrées différentes convergent vers un même résultat.
Modifiez une seule variable, dans cet ordre
- Supprimez les adjectifs relatifs à la beauté ou à la qualité qui suggèrent implicitement un seul archétype éditorial.
- Renforcez les traits structurels : forme du visage, mâchoire, dos du nez, sourcils et indices d’âge.
- Simplifiez l’action et le mouvement de caméra.
- Modifiez la graine (seed) tout en conservant inchangé le bloc d’identité révisé.
- Comparez la sortie de base avant toute amélioration.
- Si le rôle reste inapproprié, procédez à un nouveau casting avec une référence approuvée plutôt que d’épuiser davantage de graines aléatoires.
N’appliquez pas directement une passe de restauration faciale. Celle-ci peut améliorer les détails, mais ne prouve pas que l’identité sous-jacente est différente. Évaluez la diversité avant la retouche finale.
Identifier quand un doublon apparent révèle un problème d’analyse critique
Les visages petits dans les plans larges masquent les traits distinctifs. La contre-lumière, les lunettes de soleil, les cheveux devant le visage et les mouvements rapides peuvent rendre des personnes différentes semblables. Si les gros plans neutres sont bien différenciés, corrigez le plan large par le cadrage et l’éclairage plutôt que par un nouveau casting.
Examiner un jeu de personnages varié
Examinez les candidats collectivement, et non un extrait à la fois. Un résultat individuel convaincant peut tout de même dupliquer un personnage déjà approuvé. Rassemblez les images neutres sur un seul tableau, masquez les numéros de graine et les noms d’invitations, puis demandez à un relecteur de regrouper les visages apparemment apparentés. Tout regroupement accidentel est renvoyé au test de casting.

Image conceptuelle éditoriale : valider l’ensemble du casting simultanément afin qu’aucun motif facial répété ne passe inaperçu lors d’analyses séparées.
Conserver un registre de casting réutilisable
Pour chaque personnage approuvé, enregistrez l’image neutre du visage, la référence en pied, le bloc d’identité exact, la graine, le mode de tâche, l’extrait retenu et une brève note indiquant « ne pas converger vers ». N’utilisez jamais le visage d’une personne réelle sans son autorisation explicite. Séparez clairement les références fictives ou autorisées des générations rejetées.
C’est ici que Seedance Agent réduit la charge de coordination : attachez le tableau de casting au plan de prise de vue, précisez explicitement chaque rôle de référence, comparez les candidats, approuvez une identité unique et relancez uniquement le personnage ou la prise ayant échoué. L’objectif n’est pas d’automatiser le jugement esthétique, mais de conserver les éléments probants qui sous-tendent la décision de casting.
Conclusion
Lorsque MiniMax H3 génère systématiquement le même visage, traitez-le comme un problème de diversité du casting plutôt que comme un problème de cohérence identitaire : supprimez le langage générique lié à la beauté, définissez plusieurs caractéristiques structurelles, réalisez un test contrôlé avec six candidats, examinez les images neutres, et utilisez les graines comme leviers d’exploration plutôt que comme garanties. Approuvez un interprète véritablement distinct avant de passer aux références, puis conservez les registres de casting et les vérifications de continuité intégrés à la production. Pour planifier le casting, comparez les prises et transférez les identités approuvées dans les prises ultérieures sans perdre la trace des décisions prises, construisez le projet avec Seedance Agent.
Prêt à essayer par vous-même ?
Mettez en pratique les étapes de ce guide dans Seedance et transformez vos prompts ou images en vidéos abouties en quelques minutes.
Crédits offerts à l'inscription. Forfaits à partir de $28/mois.
Articles associés
D'autres articles dans la même langue à lire ensuite.

L’extension vidéo MiniMax H3 devient plus lumineuse : correction de la dérive d’exposition au point de jonction
Diagnostiquer et corriger les extensions vidéo MiniMax H3 qui deviennent plus lumineuses à l’aide de trames de jointure (seam frames), de références stables, d’appariement tonal (tone matching), de contrôles de prompt et de chaînes de clips plus sûres.
Lire l'article
Suppression gratuite du bruit de fond avec VEED : nettoyez l’audio de vos vidéos sans deviner
Utilisez VEED Clean Audio pour supprimer le bruit de fond des vidéos ou des fichiers audio, comprenez la limite d’utilisation gratuite unique, comparez les résultats et corrigez les distorsions métalliques de la voix, les échos et les variations soudaines de volume.
Lire l'articleTutoriel HeyGen Photo Avatar : d’une seule photo à une vidéo parlante naturelle
Créez un HeyGen Photo Avatar à partir d’un portrait net, générez des Looks cohérents, ajoutez voix et mouvement, et corrigez les dérives d’identité, le décalage labial, les erreurs liées aux mains et à l’arrière-plan.
Lire l'article