- Blog
- Referencia de Vidu a indicaciones para video: fórmula, ejemplos y correcciones de coherencia
Referencia de Vidu a indicaciones para video: fórmula, ejemplos y correcciones de coherencia

AI Overview
¿Qué debe incluir un prompt de Vidu «referencia a vídeo»?
Asigne un rol a cada imagen, describa una acción visible, indique el comportamiento de la cámara, defina la escena y la iluminación, y especifique qué elementos deben permanecer invariables. Cada instrucción debe ser verificable en el clip final.
¿Cuántas imágenes de referencia puede usar Vidu?
Las páginas actuales de creación de Vidu indican soporte para una a siete imágenes de referencia. Use únicamente imágenes que aporten una identidad, objeto, vestuario, entorno o restricción estilística distintiva.
¿Cómo mantener la coherencia de un personaje en Vidu?
Utilice vistas claras y compatibles, y repita un breve «bloqueo de identidad» que cubra rostro, cabello, atuendo, silueta y objetos característicos. Reduzca sujetos competidores, pronombres ambiguos y cambios innecesarios de cámara.
¿Puede Seedance Agent gestionar un flujo de trabajo con múltiples referencias?
Sí. Seedance Agent puede transformar un breve texto y las referencias en un plan de tomas revisable, mantener las restricciones vinculadas a cada toma y volver a generar únicamente las salidas que fallen en la revisión de continuidad o movimiento.
Qué deben controlar los prompts de Vidu Reference to Video
Trate cada imagen como un activo de producción
Las personas que buscan prompts de Vidu «referencia a vídeo» necesitan un prompt que explique al modelo por qué existe cada imagen cargada. El flujo de trabajo actual de Vidu acepta referencias para personajes, objetos y escenas, mientras que sus páginas de creación indican soporte para una a siete imágenes. Siete referencias débiles no son automáticamente mejores que tres claras.
Antes de redactar, asigne a cada imagen una etiqueta privada: Personaje A, Personaje B, Producto, Ubicación, Vestuario o Estilo. Luego decida si la imagen es un ancla dura de continuidad o una influencia visual flexible. Un retrato frontal puede fijar la identidad facial; una vista de cuerpo completo puede proteger la silueta y la ropa; una imagen de ubicación establece la arquitectura y la iluminación. Si dos imágenes entran en conflicto, el prompt no podrá resolverlo de forma fiable.
El espacio de trabajo «referencia a vídeo» es el lugar más directo para organizar este tipo de tarea. Si solo dispone de una imagen estática, el espacio de trabajo «imagen a vídeo» ofrece una base más sencilla antes de añadir más restricciones.

Un concepto guiado por referencias finalizado para esta guía. La mujer, el impermeable mostaza, el galgo blanco con una oreja negra, la maleta cobalto, el andén mojado y el tren plateado son las anclas de continuidad.
Defina el éxito antes de generar
Escriba una lista de cinco criterios de aceptación junto al prompt: misma mujer, marcas del perro, impermeable, geometría de la maleta y estación costera. El movimiento y el encuadre pueden variar; esas anclas no. Así se transforma una observación vaga como «se siente incorrecto» en una corrección precisa, como «restaurar la oreja derecha negra del perro y mantener la correa marrón de la maleta».
Fórmula del prompt en cinco partes
1. Roles de las referencias y anclas de continuidad
Comience con una lista compacta del reparto: «La imagen 1 corresponde al rostro y al corte de pelo bob de la mujer; la imagen 2, al impermeable mostaza; la imagen 3, al galgo blanco con una oreja negra; la imagen 4, a la maleta cobalto con una correa marrón». Evite pronombres ambiguos cuando haya dos sujetos posibles visibles.
2. Una acción con inicio y fin claros
Describa una única acción que se ajuste a la duración solicitada: «El tren se detiene, la mujer se arrodilla para enganchar la correa, luego se levanta cuando se abren las puertas». Esto es más controlable que pedir llegada, embarque, conversación, órbita de cámara y partida en un solo clip corto. Incluya una pose final para que el último segundo no se disuelva en un movimiento aleatorio.
3. Cámara, escena, iluminación y línea de bloqueo
Indique el tamaño de plano y un movimiento de cámara: «plano medio-amplio a la altura de los ojos, acercamiento lento». Termine con una línea de bloqueo: «Mantener la identidad facial, las marcas del perro, el color del impermeable, la forma de la maleta, la arquitectura de la estación y la dirección en pantalla; sin miembros duplicados, objetos sustituidos, texto ni logotipos».

Un segundo fotograma finalizado cambia la acción y la distancia de la cámara, pero conserva las anclas seleccionadas de personaje, animal, vestuario, equipaje y ubicación.
Prompts de Vidu Reference to Video listos para copiar y pegar
Prompt para personaje, animal y ubicación
«Use la Referencia 1 para el rostro, el corte de pelo negro corto y las proporciones de la mujer; la Referencia 2 para el impermeable mostaza, las botas negras y la mochila; la Referencia 3 para el galgo blanco esbelto con una oreja derecha negra; la Referencia 4 para la maleta rígida cobalto con una correa vertical marrón; y la Referencia 5 para el andén costero mojado. Un tren plateado avanza de derecha a izquierda. La mujer se arrodilla, engancha la correa marrón al collar del perro, mira hacia la puerta que se abre y se levanta. Plano medio-amplio a la altura de los ojos con acercamiento lento, luz matutina suave tras la lluvia, movimiento realista. Mantenga todas las anclas nombradas, las dos manos de la mujer, la anatomía del perro y la dirección en pantalla. Sin personas nuevas en primer plano, sin texto ni logotipos».
Si el resultado presenta dificultades, elimine una imagen no esencial de vestuario o fondo antes de añadir más texto descriptivo.
Prompt para geometría de producto
«Usa la Referencia 1 como producto exacto: botella aislante mate coral-naranja, tapa con asa negra, collar plateado estrecho, banda ondulada de líneas múltiples en crema pálido, proporciones inalteradas. Usa la Referencia 2 para el entorno de cascada de basalto húmedo. La mano de un senderista se acerca y levanta la botella mientras el agua salpica alrededor de su base. Cámara baja y cercana, ligero movimiento hacia adelante, producto nítido con cascada suavemente desenfocada, neblina fresca del amanecer y luz cálida de contorno. Conserva en cada fotograma la forma de la tapa, el ancho del collar, la colocación de la banda ondulada, el acabado superficial y el color. Sin texto en la etiqueta, sin logotipo, sin abolladuras, sin botella duplicada, sin dedos deformados ni cambios de color».

Una toma finalizada del producto facilita la inspección de la geometría, el color, la construcción de la tapa, el contacto con la mano y el movimiento ambiental.
Prompt de interacción entre dos personajes
«La Referencia 1 es el Personaje A, un cocinero con delantal carbón. La Referencia 2 es el Personaje B, un ciclista con chaqueta cobalto. La Referencia 3 es una pequeña cocina abierta con azulejos verdes. El Personaje A desliza un cuenco de cerámica sobre la encimera; el Personaje B lo atrapa con ambas manos y sonríe. Plano medio fijo con dos personajes, un suave enfoque progresivo (rack focus) desde el cuenco hasta el Personaje B, iluminación cálida proveniente de la ventana. Mantén constantes en todo momento los rostros, peinados, vestimentas, altura relativa, patrón del cuenco, disposición de la encimera y posiciones izquierda-derecha. Sin intercambio de rostros, dedos adicionales, cambios de ropa, texto de diálogo ni cortes de cámara».
Para más ejemplos de cómo un sistema de referencias difiere de un generador de una sola toma, consulta la guía de alternativas de Vidu. Esta guía ayuda a separar el acceso y la elección de producto del problema de diseño de prompts abordado aquí.
Elegir y etiquetar imágenes de referencia
Usar vistas complementarias, no casi idénticas
Un conjunto útil de personajes incluye una vista frontal, una vista en tres cuartos y una vista completa del atuendo. Un conjunto de productos puede usar un ángulo principal (hero), una vista lateral y una vista de contacto con la mano. Para una ubicación, elige una imagen amplia más un detalle que deba mantenerse visible en tomas más cercanas.
Recorta el desorden de fondo, pero conserva los detalles necesarios para la escala. Evita filtros de belleza intensos, distorsiones extremas, manos ocultas, bordes del producto ilegibles y elementos de interfaz visibles. Asigna nombres estables a las referencias guardadas, como MAYA_YELLOW_COAT o CORAL_BOTTLE_V1.
Ajustar el prompt al encuadre
Si la fuente es un retrato ajustado, no exijas una rotación corporal completa y rápida con un atuendo no visible. Comienza cerca del encuadre de la referencia, aprueba identidad y geometría, y luego amplía la distancia o el movimiento de la cámara una variable a la vez. Esto revela qué cambio provocó la deriva.
Una salida editorial existente de Seedance, no un punto de referencia oficial de Vidu. Revisa el rostro, la vestimenta, el contacto de los pies, el tráfico de fondo y la pose final mientras la cámara y la multitud se mueven.
Corregir la deriva de identidad, producto y escena
Reparar la identidad antes de añadir estilo
Si el rostro cambia a mayor distancia, acerca la cámara, reduce la rotación de la cabeza, añade una referencia más fuerte en tres cuartos y acorta la acción. Repite únicamente los anclajes faciales de mayor valor. Si la ropa cambia, nombra una vez, en la lista de personajes, la prenda exacta, su color, material y silueta, y vuelve a especificarla en la línea de bloqueo. Si dos personajes se fusionan, asignales posiciones fijas izquierda-derecha y acciones distintas.
La deriva del producto requiere lenguaje geométrico, no términos subjetivos. Especifica el tipo de tapa, asa, proporciones, ubicación de la etiqueta, material y color. Pide un solo evento de contacto, como levantar o colocar, y mantén el producto lo suficientemente grande como para ser legible. La guía de consistencia ambiental ofrece un método útil de inspección para arquitectura, accesorios, dirección de la luz y continuidad espacial en composiciones modificadas.

Un entorno cambiante y una cámara en movimiento someten a prueba con mayor exigencia la continuidad de la misma tapa, collar, banda ondulada, color y proporciones.
Separar el fallo de referencia del fallo de movimiento
Detén la salida en el primer fotograma claramente definido. Si ya hay errores de identidad o geometría, corrige las referencias y los roles en el prompt. Si la toma inicial es correcta pero los fotogramas posteriores derivan, reduce la complejidad de la acción, la amplitud del movimiento, el recorrido de la cámara o la duración. Si todo permanece reconocible pero el clip parece plano, mejora entonces el ritmo, la interpretación y la energía de la cámara. Cambiar simultáneamente las tres capas destruye el valor diagnóstico de la siguiente generación.
Una salida editorial existente y diferenciada de Seedance para revisar las manos, la geometría del instrumento, el ritmo de la interpretación, la distancia de la cámara y el resultado completo en movimiento.
Escalar tomas de referencia con Seedance Agent
Convertir fragmentos de prompt en un plan de toma controlado
La parte difícil de la producción con múltiples referencias rara vez es el primer prompt. Lo complejo es mantener alineados, a lo largo de una secuencia, los roles de las referencias, los fotogramas aceptados, la relación de aspecto, la dirección de la cámara, las aprobaciones y las notas para repetir tomas. Un prompt pegado puede describir una sola toma; no preserva automáticamente la razón por la que se eligió una referencia ni cuál restricción falló en la toma cuatro.
Seedance Agent comienza con el briefing y los recursos fuente, propone un guion y un plan de tomas para su revisión, y luego mantiene cada referencia vinculada a la toma donde resulta relevante. Puedes aprobar el plan antes de iniciar la generación pagada, comparar las salidas terminadas y volver a generar únicamente la sección débil, en lugar de reconstruir toda la secuencia. El flujo de trabajo de video con IA multimodelo explica cómo funciona esta transición cuando distintas tomas se benefician de diferentes modelos.
Usa la ruta adecuada para la tarea
Usa Vidu directamente cuando quieras probar su modelo Reference to Video actual, aprender cómo responden sus ajustes o crear un clip controlado único. Usa Seedance Agent cuando el entregable conste de múltiples tomas, partes interesadas, versiones o fechas límite, y el registro de producción tenga tanta importancia como el prompt. Conserva las mismas etiquetas de referencia y verificaciones de aceptación en cualquiera de ambas rutas, de modo que un recurso aprobado pueda trasladarse entre herramientas sin perder su significado.
Conclusión
Los prompts de referencia a video sólidos con Vidu funcionan como instrucciones de producción compactas: asigna a cada imagen un rol específico, limita la acción, nombra un movimiento de cámara, describe la escena y repite los anclajes de continuidad que deben conservarse. Comienza con el menor número posible de referencias compatibles, prueba cerca del encuadre original y diagnostica por separado la identidad, la geometría, el movimiento y el entorno antes de invertir otra generación. Cuando la idea se convierte en un entregable de múltiples tomas con aprobaciones y repeticiones selectivas, comienza con Seedance Agent y lleva las mismas etiquetas de referencia y verificaciones de aceptación a un flujo de trabajo gestionado.
¿Listo para probarlo tú mismo?
Pon en práctica los pasos de esta guía con Seedance y convierte prompts o imágenes en videos pulidos en minutos.
Créditos gratis al registrarte. Planes desde $20/mes.
Artículos relacionados
Más publicaciones en el mismo idioma que quizá quieras leer después.

Guía de configuración local de MiniMax H3: ComfyUI, modelos, VRAM y primera renderización
Configura MiniMax H3 localmente con ComfyUI, elige los archivos FL2VA o Ref2VA adecuados, planifica la VRAM, coloca cada modelo correctamente y completa una primera renderización verificada.
Leer artículo
Generador de vídeos con IA Qwen gratuito: guía de acceso, prueba y exportación
Aprenda dónde acceder a las herramientas de vídeo de Qwen, verifique los límites gratuitos, pruebe la generación de vídeos a partir de texto e imágenes, revise las opciones de exportación y traslade una idea probada al agente Seedance.
Leer artículo
Generador de vídeos AI SnapGen gratuito: pruébelo antes de comprometerse
Aprenda a verificar el acceso gratuito a SnapGen, probar la generación de vídeos a partir de texto e imágenes, revisar las exportaciones y los costos, y trasladar un concepto probado al agente Seedance.
Leer artículo