¿Qué es un prompt para convertir una imagen en vídeo?


Un prompt para convertir una imagen en vídeo le indica a un modelo de IA cómo debe evolucionar una imagen fija con el paso del tiempo. Puede describir el movimiento del sujeto, la expresión facial, el movimiento del entorno, la dirección de cámara, el orden de las escenas, el ritmo, el sonido y los detalles que deben mantenerse sin cambios, como la cara, la ropa, la forma del producto o el estilo del fondo.
¿Cómo se escribe un buen prompt para convertir una imagen en vídeo?


Empieza por el sujeto principal y, después, describe la acción y el movimiento de cámara en un orden lógico. Añade duración, iluminación, ambiente y sonido cuando sean relevantes. Termina indicando qué debe mantenerse consistente y qué debe evitarse. Los verbos claros y las tomas bien ordenadas suelen funcionar mejor que una lista larga de adjetivos visuales sin relación entre sí.
¿Qué debe incluir un prompt para convertir una imagen en vídeo?


Incluye el sujeto, la acción, el comportamiento de la cámara, los cambios de escena, el ritmo, el estilo visual, las indicaciones de audio, la duración y la proporción de salida. Indica también qué elementos deben mantenerse consistentes. En un producto, conserva la geometría y las etiquetas; en una persona, mantén la identidad, el peinado, la ropa y los rasgos faciales reconocibles en todas las tomas.
¿Puedo controlar el movimiento de cámara con un prompt?


Sí. Puedes indicar un movimiento concreto, como un acercamiento, un alejamiento, una panorámica, una inclinación, un plano de seguimiento, un seguimiento con cámara en mano, un arco cenital o una media órbita. Explica cuándo ocurre y qué debe mostrar. Si combinas la dirección de cámara con una acción clara del sujeto, al modelo le resultará más fácil interpretar el resultado.
¿Cómo mantengo la coherencia de una cara o un personaje?


Usa una imagen de referencia clara y repite los rasgos que definen al personaje, como el peinado, la ropa, los accesorios y los detalles faciales. Pide al modelo que mantenga la misma identidad en todas las escenas. Evita transformaciones innecesarias, cambios de ángulo extremos o descripciones contradictorias que hagan que el personaje cambie entre tomas.
¿Cómo puedo reducir caras, manos o productos deformados?


Mantén acciones físicamente creíbles, limita las extremidades u objetos superpuestos e indica qué formas y proporciones no deben cambiar. En los primeros planos, usa menos acciones simultáneas. Añade exclusiones directas como dedos extra, productos duplicados, deformación del rostro, cambios en las etiquetas, parpadeo o distorsión de la geometría, y luego ajusta la toma más débil.
¿Los prompts para convertir imágenes en vídeo pueden incluir sonido?


Sí, siempre que el modelo elegido admita audio. Describe el sonido ambiente, el ritmo de la música, la voz, los efectos y los momentos exactos en los que deben entrar los acentos. Para lograr un ritmo más marcado, sincroniza barridos, clics, impactos o golpes musicales con los cortes de cámara y los cambios de acción, en lugar de pedir solo música de fondo genérica.
¿Qué longitud debe tener un prompt para convertir una imagen en vídeo?


Un buen prompt puede ser un párrafo centrado o varias instrucciones cortas por toma. La longitud importa menos que la estructura. Incluye el detalle necesario para definir movimiento, cámara, tiempos, sonido y consistencia, pero elimina adjetivos repetidos o instrucciones que se contradigan. En vídeos con varias tomas, las secciones con marcas de tiempo suelen ser más fáciles de seguir.
¿Puedo usar comercialmente estos ejemplos de prompts para convertir imágenes en vídeo?


Puedes adaptar estas estructuras de prompt para anuncios de producto, publicaciones en redes, propuestas para clientes y otros usos comerciales. Asegúrate de tener los derechos o el permiso para usar la imagen subida, los elementos de marca, la imagen de las personas y el audio. Antes de publicar, revisa el resultado generado para comprobar derechos, precisión y requisitos de la plataforma.