Paramètres de la taille de lot vidéo Midjourney : choisissez 1, 2 ou 4

E
Emma Chen·12 min de lecture·Sep 12, 2026
Partager sur X
Paramètres de la taille de lot vidéo Midjourney : choisissez 1, 2 ou 4

AI Overview

Que contrôle la taille de lot vidéo Midjourney ?

Elle détermine le nombre de variations vidéo que Midjourney génère à partir d’une seule invite vidéo. Les valeurs autorisées sont 1, 2 et 4 ; la valeur par défaut est 4, tandis qu’un lot plus petit réduit le temps de GPU et le nombre de résultats à examiner.

Comment modifier la taille de lot vidéo Midjourney ?

Sur le web, ouvrez les Paramètres situés à côté de la barre Imagine, puis sélectionnez Taille de lot vidéo dans la section Autres options. Pour une invite unique ou dans Discord, ajoutez --bs 1, --bs 2 ou --bs 4 à la fin.

Quelle taille de lot utiliser pour les tests ?

Utilisez le lot 1 pour un test technique avec une première image verrouillée et une invite figée. Utilisez le lot 2 lorsque vous avez besoin d’un choix significatif ; utilisez le lot 4 lorsque l’exploration justifie le coût supplémentaire en temps de GPU et en temps d’analyse.

La taille de lot modifie-t-elle la qualité ou la durée vidéo ?

La taille de lot modifie uniquement le nombre de sorties, pas le mouvement sélectionné, la résolution ni la durée. Chaque séquence initiale dure cinq secondes ; la résolution et le mouvement sont des paramètres distincts, et chaque extension ajoute quatre secondes par étape.

Ce que contrôle réellement la taille de lot vidéo Midjourney

Les utilisateurs qui recherchent les paramètres de taille de lot vidéo MidJourney souhaitent généralement cesser de payer pour quatre variations lorsqu’ils n’en ont besoin que d’une pour tester — ou comprendre à quel moment quatre alternatives valent réellement le coup. Midjourney produit actuellement quatre sorties vidéo par défaut, mais son paramètre spécifique aux vidéos --bs permet de demander 1, 2 ou 4. Ce même choix apparaît également sous forme de paramètre persistant « Taille de lot vidéo » sur l’interface web.

Une première image finalisée représentant une danseuse vêtue d’une robe écarlate sur un désert salé réfléchissant

Une nouvelle étude basée sur une image-source pour ce guide. Une image approuvée peut produire plusieurs interprétations de mouvement, mais davantage de sorties ne sont utiles que si vous savez précisément comment vous allez les évaluer.

La taille de lot ne signifie pas images par seconde, longueur de séquence, concurrence dans la file d’attente ni résolution d’exportation. Il s’agit du nombre d’alternatives renvoyées par une seule invite vidéo. Quatre augmente les chances de trouver un cheminement de mouvement fluide ; un seul résultat est moins coûteux, mais n’offre aucune comparaison entre variantes issues de la même invite.

Gardez la taille de lot distincte de la consigne créative. L’image source détermine toujours la composition initiale et l’aspect approximatif. L’invite de mouvement décrit le sujet et le comportement de la caméra. --motion low ou --motion high modifient la tendance au mouvement ; SD ou HD modifient la résolution ; --raw, --loop et --end modifient d’autres comportements vidéo. Configurez d’abord ces paramètres, puis décidez du nombre réel de tentatives dont vous avez besoin.

Comparaison des lots 1, 2 et 4 selon le coût et l’objectif

Le tableau officiel actuel de Midjourney indique les coûts approximatifs suivants en temps de GPU pour une génération initiale de cinq secondes :

Résolution vidéo Lot 1 Lot 2 Lot 4
SD 2 minutes de GPU 4 minutes de GPU 8 minutes de GPU
HD 7 minutes de GPU 13 minutes de GPU 26 minutes de GPU

Ces chiffres constituent des estimations opérationnelles, non une garantie du temps réel d’attente. Le mode file d’attente et la demande peuvent influencer le délai d’apparition des résultats. HD coûte nettement plus cher que SD, et chaque extension prend autant de temps de GPU qu’une autre génération initiale aux paramètres choisis.

Lot 1 : valider le flux de production

Utilisez --bs 1 pour vérifier si l’image est éligible, si l’aspect est préservé, si le mouvement suit la bonne direction ou si une image finale personnalisée fonctionne. Cela convient aussi à une simple animation tournante d’un produit ou à une ambiance subtile. L’objectif est d’obtenir une réponse technique unique au moindre coût.

Un portrait stable à faible mouvement de la même danseuse vêtue d’une robe écarlate, à l’heure bleue

L’état d’esprit du lot 1 : maintenir le sujet et la caméra stables, puis vérifier une instruction de mouvement minimale avant d’élargir la recherche.

Le lot 1 est peu adapté à l’exploration ouverte. Si la prise de vue repose sur des membres complexes, des tissus, des éclaboussures, des foules ou un déplacement important de la caméra, un seul résultat peut échouer pour une raison aléatoire. Ne concluez pas que l’invite entière est erronée à partir d’un seul essai ; simplifiez plutôt le test ou passez au lot 2.

Lot 2 : équilibrer choix et coût

Le lot 2 constitue la valeur par défaut pratique pour de nombreuses premières images approuvées. Deux sorties permettent de comparer la lisibilité du mouvement, la stabilité de l’identité, la direction de la caméra et la composition finale, sans payer pour quatre. Il fonctionne bien lorsque la direction créative est fixée, mais que le modèle conserve encore une marge d’interprétation quant au rythme.

Évaluez les deux résultats avant d’apporter la moindre modification. Si aucun des deux ne satisfait aux mêmes critères, révisez l’invite. Si l’un d’eux remplit les conditions, déterminez si ce résultat gagnant suffit avant d’acheter un nouveau lot.

Lot 4 : explorer une incertitude significative

Utilisez le lot 4 lorsque la diversité est l’objectif recherché ou lorsque la prise de vue comporte une incertitude réelle en matière de mouvement. Cela inclut la chorégraphie, les tissus agités par le vent, les liquides, les mouvements dramatiques de caméra ou les expressions rythmiques d’un personnage. Quatre variantes peuvent révéler différents chemins exploitables à partir de la même image initiale, mais uniquement si l’équipe est prête à inspecter intégralement chaque séquence vidéo.

Une interprétation à fort mouvement montrant la danseuse bondissant à travers l’eau réfléchie

*Un candidat au lot 4 : tissus complexes, membres, éclaboussures, reflets et synchronisation de la caméra créent suffisamment d’incertitude pour justifier davantage d’alternatives.*Ne pas utiliser le lot 4 pour compenser un brief non résolu. Quatre résultats flous ne constituent pas une stratégie. Verrouillez à l’avance le sujet, l’action, la caméra, l’environnement, les règles de préservation et la fin avant de payer pour la variété.

Définir une valeur par défaut sur le web et la remplacer au cas par cas

Modifier le paramètre web

Sur la page Créer du web Midjourney, ouvrez le contrôle Paramètres situé à côté de la barre Imagine. Sous Plus d’options, sélectionnez Taille de lot vidéo : 1, 2 ou 4. Ce choix devient la valeur par défaut pour les futures demandes vidéo ; vérifiez-la donc si le coût vous semble soudainement différent de celui de la session précédente. La résolution et la vitesse sont des options voisines, mais indépendantes.

Pour une image source, basculez le mode de prompt en mode vidéo, puis confirmez la trame de départ, la résolution, le mouvement, la vitesse et la taille du lot. Midjourney précise que les paramètres issus de la génération de l’image source sont supprimés dès le démarrage de la tâche vidéo.

Utiliser --bs pour une seule tâche

Ajoutez le paramètre à la fin du prompt vidéo :

La danseuse se tourne vers la caméra tandis que la soie rouge ondule dans une brise lente, plan large verrouillé, préserver la silhouette du visage et de la robe --motion low --bs 2

Dans Discord, la même syntaxe permet de sélectionner 1, 2 ou 4. Un paramètre défini au niveau du prompt est utile lorsque la valeur par défaut globale est 4, mais qu’un test diagnostique doit retourner un seul résultat. Enregistrez précisément le prompt et les paramètres associés à la séquence sélectionnée ; sans cet enregistrement, vous ne pourrez pas reproduire ultérieurement un choix réussi.

Pour un flux entrée-sortie plus large, le guide en ligne sur la génération vidéo à partir d’images avec prompt explique comment verrouiller une trame source avant d’y ajouter du mouvement.

Associer la taille du lot au mouvement, à la résolution et aux extensions

Tester SD avant de valider HD

Si vous hésitez encore sur la qualité du mouvement, commencez par SD avec un lot de 1 ou 2. Passez à HD une fois que le cadrage, l’identité, le mouvement et la fin méritent d’être conservés. La documentation actuelle de Midjourney indique que tous les niveaux d’abonnement permettent de générer des vidéos en mode Rapide ; HD est disponible en mode Rapide sur les abonnements Standard, Pro et Mega, tandis que la vidéo SD Relax est limitée aux abonnements Pro et Mega.

Sortie réelle de mouvement social pour évaluer si un test SD est prêt à passer à un rendu plus coûteux

Examinez le fichier animé, pas seulement l’image fixe : la stabilité du sujet, la lisibilité du mouvement, le cadrage et la fin doivent être validés avant d’ajouter de la valeur via une résolution supérieure.

La résolution ne peut pas corriger une anatomie défaillante ou une direction de caméra erronée. Elle n’accorde qu’un plus grand nombre de pixels à une séquence de mouvement défectueuse. Utilisez des tests à faible coût pour valider le « contrat » du mouvement, puis investissez dans la direction retenue. Le rythme de livraison est également un paramètre distinct : consultez le guide sur la fréquence d’images optimale pour les vidéos IA avant l’export final.

Budgéter les extensions comme de nouvelles générations

Les vidéos initiales Midjourney durent cinq secondes. Chaque extension ajoute quatre secondes, jusqu’à un maximum de quatre extensions (soit 21 secondes au total). Comme chaque extension coûte autant de temps GPU qu’une génération vidéo initiale, un plan imprudent combinant lots et extensions peut rapidement exploser en coût.

Testez d’abord une séquence de cinq secondes en SD, puis générez une deuxième alternative uniquement si nécessaire, avant d’étendre la prise retenue. N’étendez pas systématiquement tous les résultats pour découvrir quelle ouverture fonctionne le mieux. Pour plusieurs séquences planifiées, le flux de travail multi-points clés montre pourquoi les points de contrôle sont essentiels.

Examiner un lot avant de lancer une nouvelle génération

Regardez toutes les variantes à vitesse normale, puis inspectez l’ouverture, l’apogée de l’action et la fin. Appliquez la même grille d’acceptation à chaque sortie :

Zone d’analyse Condition de validation Échec justifiant une régénération
Identité Visage, corps, produit et tenue restent reconnaissables Changement de sujet ou rupture géométrique
Mouvement L’action est continue et d’intensité conforme au brief Démarrage figé, mouvement caoutchouteux ou accélération brutale
Caméra Direction, vitesse, horizon et cadrage respectent le brief Zoom non demandé, inversion ou coupure inattendue
Environnement Lumière, réflexions et arrière-plan restent cohérents Espace déformé ou météo incohérente
Fin La dernière trame est utilisable pour une extension ou un montage Flou, occultation ou mauvaise composition
Mouvement réel d’orbite autour d’un produit, pour comparer la géométrie complète de la séquence et la cohérence de la caméra

Un autre cas de mouvement : vérifiez les réflexions, la silhouette, la vitesse d’orbite et la dernière trame sur toute la durée de la séquence.

Sélectionnez un gagnant et notez pourquoi il remplit les critères. Si les quatre échouent de manières différentes, la prise peut être trop ambitieuse : simplifiez le mouvement ou revenez à la trame source. Si tous échouent de la même façon, le brief ou la référence est probablement en cause. Si deux réussissent, privilégiez celle qui réduit le travail de montage en aval plutôt que celle dont la miniature est la plus spectaculaire.

Une trame finale alternative, sobre, montrant la danseuse marchant vers un horizon baigné de lune

Une alternative utilisable n’est pas toujours la plus marquante. Une fin stable peut avoir plus de valeur pour une extension, l’ajout de titres ou un raccord net.

Suivez le temps GPU consommé par seconde approuvée, et non le coût par prompt. Un lot de quatre produisant trois prises exploitables peut être efficace ; quatre sorties dont une seule est juste acceptable ne le sont pas. Pour les équipes comparant plusieurs fournisseurs, le guide agrégateur vidéo IA vs API directe couvre les coûts cachés liés à l’analyse et à la transmission des fichiers.

title: How to Choose the Right Batch Size for AI Video Generation description: A practical guide to selecting optimal batch size, motion settings, and extensions for AI video generation—avoiding wasted time and budget. tags: ai video, batch size, motion control, video generation, prompt engineering

Quand Seedance Agent constitue la meilleure approche

La taille de lot vidéo Midjourney est utile lorsque vous disposez déjà d’une première image solide et que vous souhaitez explorer plusieurs interprétations du mouvement. Seedance Agent s’avère plus adapté lorsque la prise de décision intervient plus tôt et s’étend davantage : définition de l’objectif d’une campagne, planification de plusieurs plans, association de références à chaque plan, génération à l’aide de modèles pris en charge, examen des résultats effectifs, et relance uniquement des parties ayant échoué.

Dans un projet multiplan, Seedance Agent permet d’établir la liste des plans et les critères d’acceptation, puis d’allouer davantage de tentatives uniquement aux moments à risque ou à forte valeur ajoutée. La taille de lot devient alors une décision de production, et non une simple habitude.

Comparez les deux approches sur un livrable unique : comptez le nombre de générations, le nombre de séquences utilisables, le temps consacré à l’examen, et le coût par seconde approuvée. Un outil direct convient à une seule expérience ; un agent géré peut réduire les révisions liées à la continuité. Le guide comparatif IA vidéo locale versus cloud aide à évaluer les compromis opérationnels.

Conclusion

Choisissez la taille de lot vidéo Midjourney en fonction du niveau d’incertitude : --bs 1 pour une vérification technique, --bs 2 pour un choix contrôlé, et --bs 4 pour un mouvement qui bénéficie réellement de l’exploration. Gardez le nombre de lots distinct du mouvement, de la résolution, de la durée et de la fréquence d’images ; testez à faible coût, examinez chaque séquence complète selon le même canevas d’évaluation, étendez uniquement le résultat retenu, et mesurez le coût par seconde approuvée. Ensuite, dès que le travail exige un plan de tournage, des références interconnectées, une génération multi-modèle et des relances sélectives — plutôt que des alternatives isolées — lancez la production avec Seedance Agent →

Commencez à générer gratuitement - sans carte bancaire

Créez des vidéos avec les crédits offerts à l'inscription, puis passez à un forfait abordable quand vous avez besoin de plus de générations.

Crédits offerts à l'inscription. Forfaits à partir de $20/mois.