MiniMax H3 – Invite négative dans ComfyUI : ce qui fonctionne réellement

E
Emma Chen·11 min de lecture·Sep 10, 2026
Partager sur X
MiniMax H3 – Invite négative dans ComfyUI : ce qui fonctionne réellement

AI Overview

MiniMax H3 prend-il en charge un prompt négatif traditionnel dans ComfyUI ?

Les points de contrôle H3 fournis en version standard sont CFG-distilled, ce qui signifie que le graphe par défaut n’utilise pas la paire classique de conditionnement positif/négatif. Commencez par intégrer des exclusions précises directement dans le prompt audiovisuel principal.

Pourquoi une zone de texte négatif peut-elle apparaître sans aucun effet ?

Un nœud personnalisé peut stocker du texte négatif sans le connecter à un mécanisme actif de guidage. Suivez le parcours de ce champ à travers le conditionnement, le module de guidage (guider) et l’échantillonneur (sampler) : la simple présence d’un widget visible ne garantit pas que le modèle en tient compte.

Comment supprimer du texte indésirable, des personnes ou des mouvements de caméra ?

Décrivez d’abord la scène souhaitée, puis ajoutez une ou deux phrases concrètes commençant par « Pas de… », liées aux risques effectivement identifiés. Formulez la contrainte de façon observable : pas de sous-titres, exactement une personne, ou caméra fixe.

Quand envisager d’utiliser un nœud communautaire de guidage négatif ?

Uniquement après avoir vérifié qu’un graphe standard, propre et non modifié, échoue encore — et à condition que le correctif (patch) soit compatible avec votre point de contrôle H3, la version de ComfyUI utilisée, et le mode de tâche concerné. Enregistrez d’abord le graphe fonctionnel, puis comparez les résultats en modifiant un seul paramètre à la fois.

Une femme seule, vêtue d’un manteau bleu, sur la terrasse calme d’un café dépourvu d’enseignes

Référence visuelle issue d’une consigne mesurable : un seul sujet, une seule tasse, aucune enseigne ni personne supplémentaire, composition avec caméra fixe. Il s’agit d’une image générée à titre illustratif, non d’une référence officielle H3.

Pourquoi la zone de prompt négatif est-elle absente

Dans les graphes de diffusion d’images, le texte positif et le texte négatif sont souvent acheminés via des branches de conditionnement distinctes. MiniMax qualifie les points de contrôle H3 FL2VA et Ref2VA publiés comme des poids CFG-distilled. Le graphe standard utilise donc son unique chemin de conditionnement principal, plutôt que l’agencement classique à deux branches.

Cela explique pourquoi un modèle H3 peut exposer une seule voie textuelle, tandis qu’un nœud communautaire affiche une zone pour le texte négatif que le module de guidage en aval n’utilise jamais. Un workflow corrigé (patché) peut ajouter sa propre branche de répulsion, mais ce comportement relève de la correction elle-même — il n’est pas inhérent à H3.

Considérez le graphe comme la source de vérité. Suivez le parcours du champ à travers le conditionnement, le guider et le sampler. S’il se termine en tant que métadonnée, texte d’aperçu ou socket non connecté, il ne peut pas influencer le rendu. Avant de déboguer les exclusions, construisez d’abord une base fonctionnelle à l’aide du guide de configuration MiniMax H3 ComfyUI.

L’absence de cette zone ne signifie pas une installation défectueuse. Rédigez un cahier des charges de scène précis, renforcez la composition positive, ajoutez des exclusions explicites, et réservez les correctifs tiers à des expérimentations contrôlées.

Transformer les objectifs négatifs en un cahier des charges de scène positif

Des formulations négatives génériques telles que « mauvaise qualité, laid, flou » ne précisent pas ce qui doit se produire dans le temps. H3 coordonne l’identité, le mouvement, la caméra, l’ambiance, le dialogue, les effets et la musique : chaque contrainte doit donc être placée à côté de l’événement qu’elle encadre.

Rédigez le prompt dans cet ordre :

  1. Verrouillez la première image. Précisez le médium, le cadrage, le nombre de sujets, la tenue vestimentaire, l’environnement et l’action initiale. Par exemple : « Un céramiste, plan taille, les deux mains visibles, façonnant un seul bol » est plus opérationnel que « pas de mains supplémentaires ».
  2. Rédigez la chronologie. Associez chaque action physique à une instruction caméra, et, pour les séquences multi-plan, à un repère temporel ou un point de coupe. Une chronologie claire laisse moins d’espace vide susceptible d’être rempli par des mouvements inventés.
  3. Dirigez l’audio séparément. Indiquez le ton ambiant de la pièce, le dialogue, les effets sonores et la musique. Si vous souhaitez le silence ou l’absence de bande originale, précisez-le explicitement dans la direction audio, plutôt que de compter sur un prompt visuel négatif pour supprimer le son.
  4. Terminez par un bloc d’exclusions restreint. N’utilisez que des contraintes observables dans le résultat final. Deux phrases ciblées sont plus faciles à diagnostiquer qu’une liste générique de tokens recyclés.

Cette approche suit la même logique de production que le guide général de prompting MiniMax H3, mais se concentre sur la prévention des échecs. L’essentiel consiste à transformer chaque crainte en une condition d’acceptation explicite. Ainsi, « pas de foule » devient « exactement un interprète visible ; l’atrium reste entièrement vide », et « pas de caméra tremblante » devient « cadre verrouillé sur trépied, sans panoramique, inclinaison, zoom, roulis ni recadrage ».

Une danseuse seule dans un atrium de musée lumineux

Pour le contrôle du nombre de sujets, examinez non seulement l’interprète central, mais aussi l’arrière-plan, les reflets, les entrées possibles et les images finales.

Modèles d’exclusion prêts à copier

Utilisez ces modèles comme fins courtes, et non comme prompts complets. Remplacez les noms propres et conservez uniquement la ligne qui traite de l’échec le plus coûteux pour votre plan.| Échec de prévention | Clause prête à copier | À inspecter | | --- | --- | --- | | Sous-titres ou marquage inventés | Aucun sous-titre, aucune légende, aucun élément d’interface, aucun logo, aucune étiquette, aucune lettre ni aucun filigrane n’apparaît à aucun moment. | Coins de l’image, surfaces réfléchissantes, faces du produit, image finale | | Personnes supplémentaires | Une seule personne est visible pendant toute la durée de la prise ; personne ne pénètre dans le cadre, ne le traverse, n’apparaît dans un reflet ni ne se forme en arrière-plan. | Entrées, fenêtres, miroirs, textures évoquant une foule | | Dérive de la caméra | La caméra reste fixée sur un trépied ; aucun panoramique, inclinaison, travelling, zoom, roulis, secousse ni recadrage automatique. | Ligne d’horizon, bords du cadre, échelle du sujet au fil du temps | | Musique non souhaitée | Seul le bruit ambiant naturel de la pièce et les effets spécifiés sont autorisés ; aucune musique extradiegetique, aucun chant, aucune acclamation ni aucun commentaire vocal. | Battement initial, transitions, fin de la piste audio | | Accessoires en double | Une bouteille et deux moitiés d’agrumes restent physiquement cohérentes ; aucun produit en double, aucun fragment flottant ni aucune étiquette changeante. | Occultation, pic de l’éclaboussure, dévoilement, reflets | | Déformation des mains | Les deux mains conservent une anatomie correcte avec cinq doigts chacune et maintiennent un contact continu avec le même bol. | Images montrant le contact, flou de mouvement, contour de l’objet |

Évitez les contradictions. « Énergie main-libre » et « aucune mobilité de la caméra » ne peuvent pas être vraies simultanément. « Espace de travail encombré » et « aucune personne » entrent également en conflit. Reformulez la scène positive pour que l’exclusion soit plausible : une plateforme vide après service, un décor fermé ou un arrière-plan en faible profondeur de champ sans signalétique lisible.

Pour l’audio natif, placez les contraintes de silence et de son dans les champs appropriés. Une structure pratique consiste en une description intégrée de la scène principale, suivie de overall_soundscape, puis de non_diegetic_music. La page du modèle MiniMax H3 constitue le point de départ idéal lorsque vous souhaitez comparer les modes de génération pris en charge avant de choisir une structure de prompt.

Une bouteille en verre non étiquetée avec une éclaboussure d’agrumes cohérente sur fond corail

Un cahier des charges produit doit définir, comme vérifications visuelles distinctes, le nombre d’objets, la zone d’étiquetage vierge, la matière, le comportement du liquide et les marques interdites.

Construire le flux de travail ComfyUI sans contrôles fallacieux

Commencez par un modèle H3 éprouvé pour la génération texte-à-audio-vidéo, première/dernière image ou référence-à-audio-vidéo. Exécutez une courte version de référence avant d’ajouter des nœuds pratiques. Enregistrez le flux de travail et ses versions ; conservez fixes la graine (seed) et la durée pendant les tests d’exclusions.

Utilisez cet audit des connexions :

Vérification Flux de travail standard Flux de travail négatif corrigé
Texte principal Parvient à la condition H3 Parvient à la condition positive
Texte négatif Rédigé sous forme d’exclusions dans le prompt principal Doit atteindre la branche négative documentée du correctif (patch)
Guideur (guider) Correspond au modèle standard Doit être le guideur attendu par le correctif
Paramètres de l’échantillonneur (sampler) Conservez les valeurs de référence Ne modifiez d’abord que la puissance du correctif
Décodage vidéo et audio Les deux sont préservés Vérifiez que le correctif ne supprime pas la condition audio

N’augmentez pas arbitrairement le facteur CFG uniquement parce qu’un widget mentionne « négatif ». Un chemin standard optimisé peut ne pas suivre les recettes de génération d’images, tandis que les nœuds communautaires peuvent définir l’échelle différemment. Vérifiez le modèle pris en charge et la connexion, puis testez une valeur modérée contre la référence.

Les références peuvent résoudre des échecs que les mots ne parviennent pas à corriger. Si le modèle continue d’inventer des vêtements, une forme de produit ou une identité, passez à un flux de travail référence-à-vidéo et fournissez une référence propre. Un ancrage positif plus fort réduit souvent les variations indésirables de façon plus fiable qu’un ajout de prohibitions.

Extrait final de performance pour vérifier le mouvement, le contact avec l’instrument et la synchronisation audio

Examinez les points de contact en mouvement et la bande-son complète. Une image fixe ne permet pas de détecter la dérive temporelle, les frappes fantômes ou la musique non souhaitée.

Diagnostiquer les échecs persistants des exclusions

Le champ négatif n’a aucun effet. Contournez le nœud personnalisé et vérifiez que le graphe de base s’exécute. Suivez si ce champ génère bien une condition utilisée par le guideur actif. Sinon, déplacez l’exclusion dans le prompt principal ; si c’est le cas, vérifiez l’échelle appliquée et la compatibilité du checkpoint.

Du texte indésirable apparaît tout de même. Supprimez les références évoquant le texte, évitez les panneaux publicitaires et les emballages, et précisez une surface vierge. Si les sous-titres sont indésirables, indiquez-le explicitement. Le nettoyage du prompt est plus sûr que l’« anti-prompting » d’une scène chargée de signalétiques.

Une personne ou un accessoire apparaît en double. Définissez le nombre dès le début et décrivez le parcours ininterrompu du sujet. L’usage répété de noms communs peut involontairement suggérer de nouvelles entités : privilégiez des références stables telles que « la même danseuse » ou « la bouteille unique ». Pour un personnage connu, attribuez clairement des références plutôt que d’empiler des images similaires.

Les mains se déforment au contact. Réduisez les actions simultanées des mains, agrandissez dans le cadre les contacts importants et simplifiez la géométrie de l’objet. La phrase d’exclusion est secondaire par rapport à la conception de la prise. Un gros plan ou un plan moyen fournit davantage de pixels aux doigts qu’un plan large avec un mouvement rapide.

Un céramiste façonnant un seul bol avec les deux mains clairement visibles

Concevez la prise de façon à rendre visible la condition d’acceptation : les deux mains, un seul accessoire, un contact continu et une échelle suffisante pour juger de l’anatomie.

L’extrait est visuellement correct mais l’audio est erroné. Vérifiez séparément le prompt audio et le chemin de décodage audio. Précisez l’ambiance souhaitée, les effets, le dialogue et l’état musical. Pour les artefacts vocaux (et non la musique indésirable), consultez le guide de dépannage MiniMax H3 pour les sons incohérents.

title=Guide complet des prompts négatifs pour Minimax H3
description=Bonnes pratiques pour les exclusions visuelles et audio dans les workflows ComfyUI avec Minimax H3 — y compris diagnostics, audits de connexion et structures natives
tags=minimax-h3
tags=negative-prompt
tags=comfyui
tags=video-generation
tags=audio-generation

Exécuter un test d’acceptation et ne relancer que l’échec

Regardez une fois l’export complet sans pause, puis examinez-le image par image avec le son. Évaluez cinq éléments comme « réussi » ou « échoué » : nombre de sujets, texte ou logos interdits, comportement de la caméra, continuité des objets et de l’anatomie, et conformité audio. Notez l’horodatage du premier instant où l’échec devient visible. Cela produit un résultat reproductible, au lieu d’une impression vague selon laquelle la « demande négative » « n’a pas fonctionné ».

Utilisez une échelle de dépannage progressive :

  1. Clarifiez la prise positive et réduisez les détails contradictoires.
  2. Ajoutez une phrase d’exclusion observable.
  3. Renforcez la référence ou modifiez l’échelle de la prise.
  4. Testez un correctif compatible de guidage négatif contre la ligne de base sauvegardée.
  5. Raccourcissez ou divisez la prise si une seule demande contient trop d’événements.

Conservez inchangés la graine approuvée, les références, le format d’image, la durée et les paramètres de l’échantillonneur, tout en modifiant un seul contrôle. Si la correction fonctionne, sauvegardez conjointement un flux de travail versionné et sa sortie. Si elle entraîne une perte audio, une raideur du mouvement ou une dérive d’identité, revenez immédiatement à l’état précédent plutôt que de tenter de compenser avec plusieurs nouveaux curseurs.

Vidéo finale du produit pour vérifier la géométrie, les artefacts textuels, le mouvement et la qualité de livraison

Un test produit en mouvement met en évidence des mutations d’étiquettes, des géométries dupliquées, des discontinuités d’éclaboussures et des sons non intentionnels que ne peut pas révéler une image fixe.

Seedance Agent peut organiser le cahier des charges de la prise, préserver les affectations de références, acheminer les relectures et régénérer uniquement la séquence ayant échoué. Utilisez-le lorsque la maintenance d’un graphe local corrigé coûte plus cher que la valeur ajoutée du contrôle supplémentaire.

Conclusion

Le flux de travail fiable de demande négative MiniMax H3 dans ComfyUI commence par l’acceptation du fait que le chemin standard CFG-distilled ne constitue pas un graphe classique de conditionnement positif et négatif. Définissez la trame et la chronologie souhaitées, ajoutez une ou deux exclusions mesurables à la description audiovisuelle principale, vérifiez chaque connexion entre nœuds, et comparez tout correctif communautaire à une ligne de base sauvegardée. Évaluez la séquence complète en mouvement et avec son à l’aide d’une fiche d’évaluation horodatée, puis modifiez uniquement le contrôle lié à l’échec. Lorsque vous souhaitez appliquer la même rigueur sans gérer vous-même les versions du graphe, le routage des références, les validations ni les relances partielles, planifiez votre prochaine vidéo contrôlée avec Seedance Agent.

Prêt à essayer par vous-même ?

Mettez en pratique les étapes de ce guide dans Seedance et transformez vos prompts ou images en vidéos abouties en quelques minutes.

Crédits offerts à l'inscription. Forfaits à partir de $20/mois.