Tutorial do Wan Animate 2: Modo Move, Modo Mix e Guia de Fluxo de Trabalho no ComfyUI

E
Emma Chen·8 min de leitura·Aug 19, 2026
Tutorial do Wan Animate 2: Modo Move, Modo Mix e Guia de Fluxo de Trabalho no ComfyUI

Visão Geral de IA

O que é o Wan Animate 2 e o que ele pode fazer?

O Wan Animate 2 é um sistema de animação de personagens de código aberto baseado no Wan 2.2. Ele transfere movimento corporal completo, expressão facial e movimento labial de um vídeo driver para um personagem de referência por meio dos modos Move ou Mix.

Qual é a diferença entre o modo Move e o modo Mix no Wan Animate 2?

O modo Move anima um personagem estático e permite que o modelo crie o fundo circundante. O modo Mix substitui a pessoa em um vídeo driver, mantendo intacta a cena original, o fundo e o áudio.

Posso executar o Wan Animate 2 localmente no ComfyUI?

Sim. O fluxo de trabalho utiliza os pesos do Wan 2.2 Animate, WanVideoAnimateEmbeds, um amostrador e um VAE. Escolha bf16 quando a memória permitir ou int8-convrot para uma configuração local mais leve.

Pronto para testar por conta própria?

Créditos grátis ao se cadastrar. Planos a partir de US$20/mês.

Experimente o Seedance grátis

Quais entradas o Wan Animate 2 exige?

Ambos os modos exigem uma imagem de referência e um vídeo driver. Recortes faciais confiáveis melhoram a identidade; o modo Mix também se beneficia de quadros de fundo limpos e de uma máscara SAM2 sólida da pessoa.

O que o Wan Animate 2 realmente faz — e por que é diferente

Modelos comuns de imagem para vídeo inventam movimento a partir de uma imagem estática e de um prompt. Já o Wan Animate 2 trata uma performance real como orientação estruturada: o driver fornece pose, sincronização, expressão facial e movimento bucal, enquanto a imagem de referência fornece a identidade do personagem. Isso o torna útil quando a performance importa tanto quanto a aparência.

Isso também difere da geração controlada por pontos finais. Um fluxo de trabalho de primeiro e último quadro define onde uma tomada começa e termina, mas não reproduz todos os detalhes entre eles. Consulte o guia MiniMax H3 de primeiro e último quadro quando o quadro de destino for mais importante do que a transferência de performance.

Oficial Wan Animate 2 · referência, driver e performance gerada

O clipe em três painéis mantém visíveis simultaneamente a referência estática, a performance driver e o resultado gerado. Trata-se de uma verificação de qualidade mais útil do que um único quadro polido, pois permite comparar diretamente o ritmo dos gestos e a identidade.

Modo Move versus Modo Mix — Escolhendo o certo

Ambos os modos transferem uma performance, mas resolvem problemas de produção distintos. Use esta tabela de decisão antes de criar máscaras ou preparar quadros adicionais:

Decisão Modo Move Modo Mix
Entradas Imagem de referência + vídeo driver Imagem de referência + vídeo driver
Fundo Regenerado pelo modelo Fundo original do vídeo é preservado
Melhor uso Ação do personagem e animação de imagens Substituição de pessoa dentro de uma cena existente
Regra em uma linha “Fazer a imagem se mover” “Substituir a pessoa no vídeo”

Escolha o modo Move quando o personagem e o movimento forem o cerne criativo e o ambiente puder mudar. Escolha o modo Mix quando a composição, os adereços, a iluminação, o movimento de câmera e o som já funcionarem bem no clipe de origem. Para uma versão voltada ao navegador da mesma ideia, experimente o fluxo de trabalho de controle de movimento antes de investir em um grafo local.

Oficial Wan Animate 2 · transferência de movimento estilizada de personagem

Este exemplo mostra por que silhueta e proporção corporal são importantes. Um driver e um personagem podem parecer completamente diferentes, mas o resultado permanece legível quando a referência possui uma pose clara de corpo inteiro e o driver permanece dentro do quadro.

O que você precisa antes de começar — Entradas e arquivos de modelo

Prepare os ativos antes de abrir o ComfyUI. Um conjunto limpo de entradas evita mais falhas do que adicionar etapas de amostragem posteriormente.

  • Vídeo driver: um único sujeito visível, enquadramento estável, membros bem definidos e movimentos faciais intencionais. Remova o tempo ocioso antes da exportação.
  • Imagem de referência: uma imagem nítida de corpo inteiro ou em três quartos do personagem, com mãos, pés e rosto visíveis e sem obstruções.
  • Recortes faciais: recortes próximos dos rostos de referência e driver para alinhamento mais forte de identidade e expressão.
  • Máscara SAM2 para o modo Mix: uma máscara sólida da pessoa, sem buracos ao redor dos cabelos, das mãos ou das roupas em movimento.
  • Quadros de fundo para o modo Mix: planos limpos da tomada original; use-os sempre que o ator substituído revelar áreas anteriormente ocultas.
  • Pesos do Wan 2.2 Animate: bf16 oferece o caminho mais limpo em precisão total; int8-convrot reduz a pressão sobre a memória com possível comprometimento de qualidade.

Hardware, quantização e tempo de decodificação ainda moldam a experiência local. As compensações descritas na nossa comparação LTX 2.5 versus MiniMax H3 constituem uma lista de verificação útil ao decidir se executará localmente ou usará um fluxo de trabalho hospedado.

Estrutura do modelo Wan Animate 2 mostrando condicionamento direto de imagem e vídeo

O diagrama oficial da arquitetura mostra como os tokens da imagem de referência, do vídeo de referência e do vídeo-alvo entram no pipeline de animação.

Fluxo de trabalho passo a passo no ComfyUI1. Carregue os pesos do Wan 2.2 Animate. Selecione bf16 para qualidade quando a VRAM permitir, ou a compilação int8-convrot para um grafo mais leve. Confirme que o VAE e o codificador de texto correspondem ao fluxo de trabalho.

  1. Conecte o nó WanVideoAnimateEmbeds. Forneça-lhe a identidade de referência, a sequência de poses do driver, os recortes faciais e a máscara SAM2. O modo Mix exige a máscara mais limpa, pois o fundo original deve sobreviver à substituição.
  2. Ajuste as dimensões do driver. Defina width, height e num_frames conforme o vídeo driver preparado. Use dimensões divisíveis por 16 e teste primeiro um curto segmento.
  3. Configure o WanVideoSampler. Adicione um prompt direto da cena, qualquer LoRA compatível, o sampler, o scheduler, a seed e a contagem de passos (step count). O prompt deve descrever aparência e ambiente, em vez de competir com a ação do driver.
  4. Escolha Mix ou Move. Encaminhe para Mix usando os quadros originais da cena e do fundo; encaminhe para Move quando o modelo deve reconstruir o ambiente ao redor da referência animada.
  5. Decodifique e salve. Inspecione o primeiro resultado em tamanho total, depois compare rosto, dedos, bordas da máscara, contato com o chão e sincronização labial em relação ao driver, antes de aumentar duração ou resolução.

Se quiser validar o personagem e o enquadramento sem instalar modelos, comece com o gerador reference-to-video, depois transfira o par de entradas aprovado para o ComfyUI.

Obtendo Melhores Resultados — Correções e Dicas Comuns

  • Deriva de fundo: forneça quadros de fundo limpos no modo Mix e use uma máscara SAM2 sólida. Suavizar (feathering) de forma excessiva pode criar um halo ao redor do ator.
  • Deriva facial: use recortes faciais nítidos, iluminação uniforme e um ângulo de referência próximo ao do driver. Evite que as mãos cubram o rosto durante o primeiro teste.
  • Incompatibilidade de resolução: certifique-se de que width, height e num_frames correspondam exatamente ao driver. Redimensione apenas uma vez antes do grafo, em vez de fazê-lo em vários nós.
  • Lábios não naturais: escolha um driver com boca visível, sílabas claras e pouca borrão de movimento (motion blur). Ângulos de perfil extremos reduzem os detalhes labiais utilizáveis.
  • Iteração lenta: aplique uma LoRA de step-distillation lightx2v compatível e comece com um clipe curto. Menos passos são valiosos para testes, mas sempre compare a execução final com a linha de base não destilada.

Altere apenas uma variável por vez. Uma seed fixa, um curto segmento driver e um conjunto de entradas salvo transformam cada nova tentativa numa comparação útil, em vez de num novo experimento.

Casos de Uso — O Que Você Pode Criar com o Wan Animate 2

  1. Apresentador IA ou humano digital — Move: anime um retrato limpo de apresentador a partir de uma performance gravada, quando o cenário puder ser regenerado ao redor do apresentador.
  2. Substituição de modelo em e-commerce — Mix: mantenha a disposição do produto e o movimento da câmera, substituindo o intérprete por um personagem da campanha.
  3. Animação de IP personalizado — Move: transfira gestos humanos e sincronização facial para uma mascote, ilustração ou personagem 3D estilizado.
  4. Dança e ações UGC — Move: transforme uma única imagem aprovada num clipe social orientado por movimento, sem precisar animar manualmente poses-chave.
  5. Substituição em lote de personagens publicitários — Mix: preserve a mesma edição, localização, adereços e áudio, adaptando apenas o talento em tela para múltiplas variantes.

Para personagens de marca recorrentes, a consistência do conjunto de dados é mais importante do que adicionar imagens aleatórias. As práticas de preparação e validação descritas em nosso guia de treinamento LoRA MiniMax H3 se aplicam bem a projetos personalizados de animação.

Conclusão

A regra mais simples é: Move = animar a imagem; Mix = substituir a pessoa no vídeo. Comece com uma referência limpa e um driver curto, fixe dimensões e máscaras, e só então escale após confirmar que identidade e movimento permanecem estáveis. Se quiser o mesmo fluxo de trabalho orientado por referência sem manter pesos e nós locais, crie seu próximo vídeo IA no Seedance →.

Pronto para testar por conta própria?

Coloque os passos desta guia em prática com Seedance e transforme prompts ou imagens em vídeos polidos em minutos.

Créditos grátis ao se cadastrar. Planos a partir de US$20/mês.