- Блог
- MiniMax H3 Ref2V и FL2VA: какой рабочий процесс следует использовать?
MiniMax H3 Ref2V и FL2VA: какой рабочий процесс следует использовать?

MiniMax H3 Ref2V против FL2VA — это не простое соревнование по качеству. Это две группы задач, созданные для разных типов управления. Официальное название Ref2V — Ref2VA: в нём изображения, видео и аудио используются в качестве многократно применимых ссылок на субъект, стиль, движение или голос. FL2VA использует ноль, один или два ключевых кадра для определения начала, конца или обоих этих моментов одного плана.
Практический вопрос поэтому звучит не как «какая контрольная точка лучше?», а как «что должно остаться неизменным в этом плане?». Если личность или продукт должны сохраниться при новом ракурсе камеры и в новой среде — выберите Ref2VA. Если композиция в начале или конце должна быть точной — выберите FL2VA.
Обзор ИИ
В чём основное различие между MiniMax H3 Ref2V и FL2VA?
Ref2VA переносит многократно применимые ссылки на субъект, стиль, видео или аудио в новый составленный план. FL2VA анимирует от первого кадра к последнему или между двумя конечными точками.
Следует ли использовать Ref2VA или FL2VA для обеспечения согласованности персонажа?
Используйте Ref2VA, когда персонаж должен появиться в новых локациях или под другими углами камеры. Используйте FL2VA, если у вас уже есть точная композиция, которую вы хотите анимировать.
Могут ли оба режима MiniMax H3 генерировать аудио?
Да. Обе группы задач генерируют видео с родным стерео-аудио. Ref2VA является более предпочтительным выбором, когда аудиоклип или тембр голоса входят в пакет ссылок.
Какой режим проще использовать для первого теста?
Обычно проще использовать FL2VA, поскольку он может начинаться с одного изображения и одного промпта. Ref2VA становится ценным, когда одного кадра уже недостаточно для передачи идентичности, движения или аудиоинформации.
Ref2VA против FL2VA: краткое правило выбора
Пользователи, сравнивающие эти режимы, обычно хотят получить чёткое правило, применимое до загрузки сотен гигабайтов весов или создания двух графов ComfyUI. Используйте это правило: FL2VA сохраняет конечную точку; Ref2VA сохраняет роль ссылки.
| Производственная задача | Более подходящая отправная точка | Почему |
|---|---|---|
| Анимация готового статичного изображения | FL2VA | Исходное изображение — это точный первый или последний кадр композиции |
| Соединение спроектированного начала и конца | FL2VA | Два ключевых кадра определяют обе конечные точки |
| Помещение одного и того же актёра в другую локацию | Ref2VA | Идентичность может быть отделена от новой композиции плана |
| Повторное использование продукта в нескольких рекламных сетапах | Ref2VA | Несколько ракурсов могут описать геометрию и материалы |
| Повторное использование голоса, фоновой атмосферы или движений | Ref2VA | Аудио и видео могут быть назначены в качестве ссылок |
| Генерация исключительно по тексту без визуального ввода | Семейство FL2VA | То же семейство контрольных точек также поддерживает генерацию видео по тексту |
Выход H3 — это 24 fps с родным стерео-аудио 32 kHz, а базовый рабочий процесс обычно даёт разрешение 768p до любого отдельного этапа регенерации в высоком разрешении. Эти общие спецификации выхода не устраняют различия в условии генерации. Выбор контрольной точки по-прежнему определяет, какой тип доказательств модель получает на вход.
Для более широкого введения в многомодальную ссылочную привязку см. руководство по видео-ссылкам MiniMax H3.
Когда Ref2VA является лучшим инструментом
Вам нужен субъект, а не застывшая композиция
Ref2VA лучше всего понимать как кастинг. Предоставьте доказательства того, кто или что должно оставаться узнаваемым, а затем опишите новый план. Открытая модель принимает до девяти изображений, до трёх видео-ссылок и до трёх аудиоклипов — максимум двенадцать файлов всех типов ссылок. Продолжительность видео- и аудиоссылок ограничена, поэтому каждый ресурс должен выполнять чётко определённую функцию.
Не подавайте девять почти идентичных портретов только потому, что доступно девять слотов. Полезный пакет персонажа может содержать чистый вид лица, вид тела в три четверти и деталь гардероба. Пакет продукта может включать фронтальный, боковой и крупный планы геометрии. Ссылка на движение должна демонстрировать временные параметры или движение камеры, которые невозможно передать статичными изображениями.

Оцените форму лица, седые волосы, кобальтовую куртку и серёжку при значительном изменении объектива, освещения и окружения — именно такой тип доказательств должен проверять тест Ref2VA.
Назначьте каждой ссылке одну задачу
Сильный промпт Ref2VA указывает каждое входное данные и его роль. «Изображение 1 определяет актёра», «Видео 1 задаёт движение камеры на тележке» и «Аудио 1 задаёт тембр голоса» — это яснее, чем требовать от модели скопировать всё со всего. Если две ссылки противоречат друг другу, укажите, какая из них имеет приоритет в отношении лица, гардероба, движения, окружения и звука.
Официальный результат шаблона Ref2VA: оцените, сохраняются ли идентичность и стиль при генерируемом движении, а не судите лишь по одному резкому кадру.
Для готовой к использованию структуры см. руководство по промптам MiniMax H3, где объясняется, как разделить определения субъекта от целевого плана и звукового ландшафта.
Когда FL2VA является лучшим инструментом
Один кадр уже содержит ответ
Выберите FL2VA, когда исходный материал — это не просто вдохновение, а сам кадр. С одним изображением вы можете использовать его как первый кадр и анимировать движение вперёд или как последний кадр и создать движение, завершающееся именно в нём. С двумя изображениями модель получает чётко заданные визуальные точки отсчёта. Это делает FL2VA полезным для контролируемых раскрытий сцен, совпадающих по кадру переходов (match cuts), циклических анимаций, появления титульных надписей, трансформаций продуктов и действий, которые должны точно завершиться в заранее спроектированной позе.
Распространённая ошибка — требовать ракурс камеры, который невозможно реализовать на основе исходного кадра. Крупный портрет не содержит информации о спине куртки, общей обстановке помещения или походке актёра. FL2VA может восполнить недостающие данные, но каждое такое «изобретение» повышает риск нарушения непрерывности. Если задача требует создания принципиально нового кадра, а не движения внутри заданной композиции, переключитесь на Ref2VA.

Полезная проверка качества FL2VA заключается в оценке правдоподобности промежуточного движения при одновременном сохранении запланированной конечной позы, геометрии поезда, направления движения и одежды.
Проектируйте совместимые начальный и конечный кадры
Начальный и конечный кадры должны соответствовать друг другу по идентичности объекта, одежде, геометрии сцены, соотношению сторон и физически возможному движению. Крупные, необъяснимые различия заставляют модель одновременно решать сразу несколько задач. Если на первом изображении показан стоящий актёр на станции, а на последнем — другой объектив, другой наряд, другой сезон и другое место, переход может потратить всё отведённое время на морфинг вместо выполнения заданного действия.
Официальный результат FL2VA: обратите внимание на точность конечного кадра, траекторию между кадрами и соответствие звукового сопровождения визуальному действию.
Руководство MiniMax H3 по работе с первым и последним кадром подробнее рассматривает проектирование таких точек отсчёта.
Настройте правильный рабочий процесс ComfyUI
Загружайте только необходимую группу задач
MiniMax H3 предоставляет отдельные наборы весов (FL2VA и Ref2VA). Это не два пункта меню, привязанных к одной и той же графовой структуре. FL2VA принимает текстовый запрос и опционально — начальное и конечное изображения в качестве условий. Ref2VA принимает упорядоченные ссылки на изображения, видео и аудио, а также текстовый запрос, определяющий, как эти ссылки связаны с целевым результатом.
Начните с проверки минимально возможной графовой структуры. Для FL2VA используйте один чистый начальный кадр, краткое указание по движению, фиксированное значение seed и короткую продолжительность. Добавьте конечный кадр только после того, как результат на одном кадре будет демонстрировать естественное движение. Для Ref2VA начните с одного изображения идентичности и одного описания целевого кадра. Добавляйте второй ракурс, видеоролик с движением или аудиоклип с голосом только тогда, когда анализ ошибки покажет, каких данных не хватает.
Руководство MiniMax H3 по настройке ComfyUI содержит полную инструкцию по локальной установке. Храните наборы весов в каталогах с понятными именами, чтобы загрузчик с кэшированием не принял тест Ref2VA за тест FL2VA.
Описывайте целевой результат, а не список ссылок
После задания ссылок опишите готовое видео в хронологическом порядке: укажите ракурс камеры, действие, окружение, диалог, фоновую атмосферу и музыку. Не тратите весь запрос на повторение того, что уже видно на исходных изображениях. Ref2VA требует чёткого описания нового кадра; FL2VA требует правдоподобной траектории движения между уже видимыми состояниями.
Протестируйте оба режима на одной и той же задаче
Оценивайте именно ту ошибку, которая имеет значение
Запустите одну и ту же творческую задачу в обоих режимах только тогда, когда она одинаково корректно формулируется для каждого из них. Зафиксируйте продолжительность, соотношение сторон, намерение запроса, политику seed и критерии оценки. Затем оцените идентичность объектов, геометрию предметов, точность конечного кадра, качество движения, контроль над камерой, релевантность звука и частоту кадров, пригодных для использования.
Ref2VA должен показать лучший результат, если один и тот же объект должен сохраниться в новой композиции. FL2VA должен показать лучший результат, если начальная или конечная композиция должна точно соответствовать входным данным. Более чёткий кадр не компенсирует наличие неправильного актёра; идентичный актёр не компенсирует пропуск требуемого финального кадра.

Для продуктов проверяйте геометрию решётки, расположение шкалы, форму ручки, износ краски и количество кнопок в разных средах — а не только общий цвет.
Считайте принятые результаты, а не попытки рендеринга
Самый экономичный рабочий процесс — тот, который даёт утверждённый кадр с минимальным числом перезапусков. Фиксируйте причину каждой неудачи. Если FL2VA систематически меняет идентичность при крупном движении камеры, задача, скорее всего, требует Ref2VA. Если Ref2VA регулярно не попадает в требуемую начальную или конечную композицию, укажите эту точку отсчёта через FL2VA вместо добавления всё новых описательных прилагательных.
Для более длинных последовательностей передавайте утверждённый результат в рабочий процесс MiniMax H3 с несколькими ключевыми кадрами, а не ожидайте, что одна генерация решит всю сцену.
Используйте Seedance Agent, если вам не нужны две локальные конвейерные системы
Локальный путь с открытыми моделями обеспечивает глубокий контроль, однако операционные затраты растут, когда каждый кадр требует выбора набора весов, очистки ссылок, переформатирования запросов, отслеживания версий и ручных перезапусков. Именно здесь Seedance Agent вписывается наиболее естественным образом.Назначьте агенту творческую цель и набор справочных материалов, затем проверьте предложенный план съёмок перед тем, как тратить ресурсы на финальную генерацию. Агент может сохранять справочные роли в рамках брифа, выбирать подходящий путь генерации, структурировать альтернативы и перезапускать только неудачные кадры вместо того, чтобы заставлять вас заново создавать весь локальный граф. Полезное преимущество заключается не в сокрытии модели, а в объединении решений, доказательств, результатов и истории одобрений.
Используйте локальный Ref2VA или FL2VA, когда требуется воспроизводимый контроль на уровне узлов и имеется соответствующее оборудование для поддержки обоих семейств задач. Используйте хостинговый агент, если вы хотите перейти от справочных материалов к утверждённым кадрам без необходимости рассматривать настройку контрольных точек как вторую производственную среду. Вы можете запустить рабочий процесс с помощью Seedance Agent и сравнить реальные результаты до того, как приступить к выполнению более крупной последовательности.
Заключение
Сравнение MiniMax H3 Ref2V и FL2VA становится простым, как только вы определите инвариант. Выбирайте Ref2VA, когда актёр, продукт, стиль, сигнал движения или голос должны сохраниться в новом компоновочном кадре. Выбирайте FL2VA, когда один предоставленный кадр точно соответствует требуемой композиции для анимации, либо два кадра чётко задают начальное и конечное состояние. Создайте минимально возможный граф, назначьте каждой справочной загрузке одну роль, протестируйте на основе доли принятых результатов и смените режим, если сбой покажет, что вы защищаете не то, что нужно. Если вы хотите использовать ту же логику планирования справочных материалов, выбора моделей, проверки и частичного перезапуска без необходимости поддерживать два локальных конвейера, попробуйте рабочий процесс Seedance Agent.
Готовы попробовать сами?
Примените шаги из этого руководства в Seedance и превратите промпты или изображения в готовые видео за считанные минуты.
Бесплатные кредиты при регистрации. Тарифы от $20 в месяц.
Похожие статьи
Еще материалы на этом же языке, которые стоит прочитать дальше.

Пакетная обработка нескольких видео в ComfyUI: надежный рабочий процесс с папками
Пакетная обработка нескольких видео в ComfyUI с надежной итерацией файлов, отдельными выходными данными, сохранением аудио, проверкой частоты кадров и восстанавливаемыми заданиями.
Читать статью
Seedance 2.5 AI Film Cost: Составьте бюджет короткометражного фильма до рендеринга
Оцените стоимость создания фильма в Seedance 2.5 с использованием ИИ, исходя из тарифных планов, количества кадров, коэффициента повторных попыток, разрешения, аудио и финальной обработки — до того, как потратить кредиты.
Читать статью
MiniMax H3 многоопорный рабочий процесс: контроль временных параметров, непрерывности и переходов
Создайте в ComfyUI многоопорный рабочий процесс MiniMax H3, размещайте изображения или аудио-подсказки на точных кадрах, сохраняйте непрерывность и управляйте производством с помощью Seedance Agent.
Читать статью