- Blog
- Ejemplos de indicaciones para vídeo con Gemini AI: Escenas listas para copiar de Veo y una fórmula mejorada de indicaciones
Ejemplos de indicaciones para vídeo con Gemini AI: Escenas listas para copiar de Veo y una fórmula mejorada de indicaciones

Resumen técnico de la IA
¿Qué debe incluir una indicación para vídeo con IA Gemini?
Describa el formato del vídeo, el sujeto, la acción ordenada, el entorno, el estilo visual, la composición, el movimiento de cámara, la iluminación y el audio. Asigne una única toma clara una tarea manejable, en lugar de solicitar una película completa en una sola generación.
¿Puedo copiar directamente estas indicaciones para vídeo con Gemini?
Sí. Reemplace las variables en mayúsculas y mantenga intacta la estructura de la toma en la primera ejecución. Luego modifique un solo elemento cada vez para determinar si la mejora provino del movimiento, la cámara, el estilo o el audio.
¿Cómo indico diálogos en vídeos con Gemini?
Nombre al hablante visible, escriba la frase breve exacta entre comillas, describa la entonación y el sonido ambiental de la habitación, y solicite «sin subtítulos» cuando no se desee texto. En la primera prueba, mantenga un único hablante y una sola oración.
¿Cómo ayuda Seedance Agent en la producción de vídeos con Gemini?
Use Seedance Agent para organizar referencias, dividir un concepto en tomas, comparar versiones, registrar aprobaciones y reemplazar únicamente el fragmento débil. Convierte generaciones independientes en un flujo de trabajo de producción revisable.
Use una fórmula de indicación para vídeo con Gemini de nueve partes
Las personas que buscan ejemplos de indicaciones para vídeo con IA Gemini suelen tener una idea, pero les falta el lenguaje propio de la producción. «Crea un anuncio cinematográfico de café» deja que el modelo decida, de forma simultánea, el sujeto, la acción, la cámara, el ritmo, la iluminación y el sonido. Una indicación más sólida asigna explícitamente cada una de esas decisiones, manteniendo la toma lo suficientemente corta como para ejecutarla con éxito.
Use este orden reutilizable: formato + sujeto + acción ordenada + entorno + estilo + composición + cámara + iluminación + audio + restricciones. «Formato» significa la solicitud práctica de entrega, como una toma continua en relación 16:9 de un producto o un clip vertical para redes sociales. «Acción ordenada» especifica qué ocurre primero, luego y por último. Las «restricciones» protegen los detalles cuya modificación haría inutilizable la toma.
La guía oficial de Google para Veo separa el sujeto, la acción, el estilo, la posición y el movimiento de la cámara, la composición, el enfoque, la ambientación y el audio. Eso constituye una buena lista de verificación, pero no es una fórmula mágica. Veo sigue generando una nueva interpretación cada vez. El hábito útil consiste en redactar una toma observable, inspeccionar el resultado en movimiento y revisar la variable fallida más pequeña.
Use esta plantilla para completar:
Cree un vídeo en [FORMATO] de [SUJETO] en [ENTORNO]. El sujeto primero [ACCIÓN 1], luego [ACCIÓN 2], y finaliza con [ACCIÓN 3]. Estilo visual: [ESTILO]. Composición: [TAMAÑO DE PLANO, ÁNGULO, UBICACIÓN DEL SUJETO]. Cámara: [UN MOVIMIENTO DE CÁMARA]. Iluminación y atmósfera: [ILUMINACIÓN]. Audio: [AMBIENTE, EFECTOS, MÚSICA O DIÁLOGO]. Preservar [ANCLAJES DE IDENTIDAD/OBJETO/ENTORNO]. Evitar [FALLOS, TEXTO, CORTES O SUJETOS ADICIONALES].
Los cuatro ejemplos siguientes son plantillas editoriales basadas en categorías documentadas de indicaciones. Las imágenes estáticas adjuntas muestran qué planificar e inspeccionar; no son resultados oficiales de Gemini. Para una sintaxis más amplia, independiente del modelo, use la guía de indicaciones para vídeo de Seedance.

Imagen estática editorial original. Defina el objeto protagonista, la iluminación práctica, el movimiento de la tela y la tarea de la cámara antes de generar la toma en movimiento.
Cuatro ejemplos de indicaciones para vídeo con IA Gemini listas para copiar
Acción cinematográfica de viaje
Cree una toma cinematográfica continua en relación 16:9 de seguimiento de un ciclista adulto con una chaqueta amarilla impermeable, pedaleando por una calle ribereña europea mojada durante la hora azul. El ciclista entra desde la izquierda, pasa cerca de la cámara y continúa hacia el puente iluminado. Cámara baja a la altura de la rueda, composición media y amplia, seguimiento lateral suave a velocidad coincidente, rotación realista de las ruedas y salpicaduras de agua, reflejos en el pavimento, cielo fresco con farolas cálidas. Audio: silbido de neumáticos sobre asfalto mojado, ligero movimiento de la cadena, tráfico distante, sin música ni voz. Preservar al ciclista, la chaqueta, el cuadro de la bicicleta, el número de ruedas, la dirección de la calle y las condiciones meteorológicas durante toda la secuencia. Sin cortes, logotipos, texto, ciclistas duplicados, ruedas deformadas ni órbita repentina de la cámara.
Esta indicación otorga al sujeto y a la cámara trayectorias compatibles. Si la bicicleta se curva, bloquee la cámara y acorte el paso antes de añadir el seguimiento.

Imagen estática original de planificación. Revise la geometría de las ruedas, el contacto con la calzada, los reflejos y la identidad del ciclista a lo largo de todo el recorrido.
Anuncio de producto con geometría controlada
Cree un vídeo premium en relación 16:9 en macro de una botella de perfume de vidrio sin marca, de color azul cobalto, colocada sobre piedra oscura y mojada. Comience con un primer plano cerrado fijo en tres cuartos. Una estrecha cinta de agua describe un arco detrás de la botella, de izquierda a derecha, mientras la cámara realiza un avance lento de diez centímetros. Una luz fría y dura de contorno define los bordes del vidrio; una luz lateral más suave revela el líquido y la tapa. Finalice con la botella centrada y completamente inmóvil durante un segundo. Audio: un único barrido limpio de agua, diminutas salpicaduras sobre la piedra, fondo tonal bajo y contenido. Preservar la forma rectangular exacta de la botella, el tamaño de la tapa, el color azul, la cara frontal sin etiqueta, la superficie de la piedra y la dirección de la luz. Sin botellas adicionales, texto, logotipo, vidrio derretido, cambio de tapa, salpicaduras que cubran el producto ni cortes.
Las indicaciones para productos se benefician de un bloqueo geométrico y una pausa final. Si el agua oculta la botella, reduzca el arco en lugar de reescribir la descripción de la botella. El flujo de trabajo de imagen a vídeo para productos resulta útil cuando una fotografía de empaque aprobada debe seguir siendo reconocible.

Imagen estática original de planificación para producto. El contorno de la botella, la tapa, los bordes del vidrio y la cara sin etiqueta son los anclajes de aceptación.
Escena de diálogo con sonido ambiental natural> Cree una toma documental continua en formato 16:9 en una cálida cocina de restaurante. Un chef adulto ficticio, con chaqueta blanca, coloca un plato de cerámica sobre el pass, mira hacia un colega fuera de cámara y dice con calma: «La mesa doce está lista». Plano medio a la altura del mostrador, ligero movimiento manual tipo «respiración» sin temblor, profundidad de campo reducida, luces prácticas de tungsteno, vapor visible, otro cocinero en el fondo desenfocado que no habla. Audio: diálogo exacto una sola vez, sonido natural del contacto del plato, ventilación suave, ambiente culinario contenido, sin música. Mantenga coherentes el rostro del chef, su chaqueta, sus manos, el plato, la disposición de los alimentos, el mostrador y la iluminación. Sin subtítulos, leyendas, logotipos, diálogo adicional, movimiento labial previo a la frase, corte de cámara ni manos adicionales en primer plano.
Un diálogo breve reduce los conflictos temporales para el modelo. Si las palabras son incorrectas, conserve la descripción visual y simplifique la frase; si el rostro cambia, use una imagen de referencia y reduzca el movimiento de cámara. Para un flujo de trabajo de audio especializado, compare la guía de vídeo con audio nativo.

Imagen fija original de planificación del diálogo. Verifique simultáneamente el contacto de las manos, la continuidad del plato, el vapor, la dirección de la mirada, la sincronización labial y la actividad de fondo.
Revelación vertical para redes sociales
Cree un vídeo social continuo en formato 9:16 que muestre una pequeña radio vintage roja sobre una mesa cubierta con lino, en un estudio creativo luminoso. Comience con un primer plano detallado del dial de sintonía. Retrase lentamente mientras una cortina se mueve con la brisa y la luz solar avanza sobre la mesa, revelando progresivamente toda la radio y una taza junto a ella. Termine con un plano medio centrado, dejando espacio claro por encima de la radio para posibles ediciones posteriores. Estilo editorial cálido y natural, tejido y polvo realistas iluminados por el sol. Audio: tono ambiental suave, crujido de la cortina, un solo clic analógico suave, sin voz ni música. Preservar la forma de la radio, su acabado rojo, las posiciones del dial, los objetos sobre la mesa, la dirección de la ventana y la luz diurna. Sin texto en pantalla, logotipo, controles de transformación, objetos adicionales, cambio brusco de exposición, corte brusco ni rotación.
La revelación presenta un único objeto protagonista, un único movimiento de cámara y dos movimientos ambientales. Esa es suficiente actividad visual para una toma vertical corta.
Adapte un prompt sin perder control
Copiar un ejemplo sólido es solo la primera prueba. Guarde el prompt, la referencia, la relación de aspecto, la duración y la salida juntos. Observe todo el clip una vez a velocidad normal antes de pausarlo en los defectos. Clasifique el fallo como relacionado con el sujeto, la acción, la cámara, el entorno, el audio o la entrega. Luego, modifique únicamente esa categoría.
Si la acción es incorrecta, reescríbala como tres verbos ordenados y elimine el lenguaje decorativo. Si la cámara ignora la indicación, use un movimiento familiar —plano fijo, panorámica, inclinación, seguimiento o acercamiento— y especifique qué permanece enmarcado. Si la escena se desvía, repita dos o tres anclajes, como el color de la vestimenta, el contorno de una botella, la distribución del mostrador o la hora del día. Si el audio compite con el diálogo, liste primero el habla y reduzca el ambiente sonoro.
Las instrucciones negativas funcionan mejor cuando nombran condiciones de fallo visibles: sin sujeto adicional, sin subtítulos, sin cambios en la geometría del producto, sin cortes. Una larga lista de negaciones abstractas puede diluir la acción principal. Los ejemplos de prompts para movimientos de cámara ayudan a traducir la dirección en una toma que el modelo pueda intentar.
Use referencias para lo que el texto describe deficientemente. Una imagen puede anclar identidad, vestimenta, forma del producto, composición y paleta. Una breve referencia de movimiento con licencia puede transmitir el ritmo. Mantenga clara la procedencia y evite solicitar el estilo reconocible de un artista vivo o un intérprete. La guía de flujo de trabajo «referencia a vídeo» explica cómo preparar material fuente limpio.
Revise el resultado en movimiento, no la imagen fija
Una primera imagen hermosa puede ocultar un clip defectuoso. Inspeccione la identidad del sujeto, la geometría de miembros u objetos, el contacto con el suelo o los accesorios, la trayectoria de la cámara, la continuidad del fondo, la dirección de la iluminación, la sincronización del audio, la precisión del diálogo y la postura final mantenida. Registre «aprobado», «reparación necesaria» o «rechazado» para cada categoría.
Este es un ejemplo independiente en movimiento de Seedance para practicar la revisión de diálogo y continuidad. No es una salida de Gemini y no sirve como punto de comparación para Veo.
Para imágenes de productos, rechace cualquier toma en la que el empaque cambie, incluso si el efecto de salpicadura parece impresionante. Para el diálogo, escuche una vez sin mirar, luego vea el vídeo en silencio para aislar el habla y la sincronización facial. Para la acción, inspeccione los cruces y las oclusiones fotograma a fotograma. Una toma utilizable debe resistir su edición prevista, no simplemente producir una miniatura impactante.
Convierta prompts separados en un vídeo corto
Las escenas largas se vuelven más fiables cuando se planifican como tomas cortas con límites compatibles. Defina un fotograma inicial, una acción principal y un estado final para cada toma. Reutilice los mismos anclajes de sujeto y entorno, pero asigne a cada prompt únicamente la tarea de cámara que requiere. Enlace las tomas en una pose mantenida, un gesto completado, una colocación de objeto o una base sonora estable.
Seedance Agent ayuda a gestionar esta capa de producción. Almacene la referencia aprobada, la lista de tomas, las versiones de los prompts, las tomas generadas y las notas de aceptación en un mismo lienzo; compare alternativas; vuelva a generar únicamente la toma débil; y luego ensamble los clips aprobados. Esto resulta especialmente útil cuando Gemini crea una revelación de producto sólida pero un diálogo débil, o una acción inicial buena pero un final inestable. El agente coordina el trabajo sin pretender que un único prompt garantiza una película terminada.
Mantenga un registro conciso de prompts: versión, variable modificada, efecto esperado, resultado y decisión. Tras tres fallos, simplifique la toma.
Guarde esta lista de verificación de promptsAntes de generar, confirme el sujeto, el orden de la acción, la cámara, la iluminación, el audio, los puntos de anclaje de continuidad, la relación de aspecto y la pausa final.
Conclusión
Los mejores ejemplos de indicaciones (prompts) para vídeos con IA Gemini se comportan como resúmenes de tomas: identifican un único sujeto, ordenan la acción, definen el entorno y el estilo, asignan un único movimiento de cámara, especifican la iluminación y el audio, protegen los puntos de anclaje de continuidad y nombran los fallos visibles que deben evitarse. Copie un ejemplo, reemplace únicamente las variables que comprenda, revise el resultado animado completo y revise una categoría a la vez; cuando el concepto requiera varias tomas coordinadas, planifíquelas, compárelas y ensámbleselas en Seedance Agent.
¿Listo para crear tu propio video con IA?
Convierte ideas, prompts de texto e imágenes en videos pulidos con Seedance. Si este artículo te ayudó, el siguiente paso más rápido es probar el producto.
Créditos gratis al registrarte. Planes desde $28/mes.
Artículos relacionados
Más publicaciones en el mismo idioma que quizá quieras leer después.

Cómo mantener la coherencia de la forma del producto en los anuncios de video con IA
Bloquee la geometría del producto, el empaque, las etiquetas, las referencias, los ángulos de cámara y las revisiones de aprobación para que los anuncios de video con IA conserven el SKU real en cada plano.
Leer artículo
Cómo hacer que un vídeo generado por IA siga una acción de varios pasos
Planifique acciones atómicas, transiciones de estado, sincronización, continuidad y entrega entre planos para que un vídeo generado por IA complete una secuencia en el orden previsto.
Leer artículo
Editar video con texto en Pictory: recortar una grabación a partir de su transcripción
Sube una grabación a Pictory, verifica su transcripción, elimina texto para recortar el video, corrige cortes bruscos y subtítulos, añade imágenes B-roll y exporta una versión final limpia.
Leer artículo