Imagen a video (I2V) es una técnica de IA generativa que da vida a una imagen fija. Tú aportas una imagen —una foto de producto, un retrato, una ilustración— y el modelo genera un video que arranca exactamente desde esa imagen y la pone en movimiento, guiado por un prompt de texto opcional.
Cómo funciona
En la generación de imagen a video, tu imagen se usa como el primer fotograma: un ancla visual que el modelo debe respetar. A partir de ahí, un modelo de difusión de video predice cómo debe evolucionar la escena: el pelo se mueve con el viento, el vapor sube de la taza, la cámara avanza lentamente. El prompt de texto ya no necesita describir cómo se ven las cosas (la imagen ya lo dice); describe qué pasa después.
¿Por qué partir de una imagen?
Comparado con el texto a video, partir de una imagen te da algo muy valioso: control sobre el aspecto exacto. La composición, los colores, el rostro, la etiqueta del producto: todo queda fijado desde el primer fotograma. Esto convierte al I2V en el modo ideal cuando:
-
Tienes activos de marca — anima una foto de producto sin que el modelo reinvente tu empaque.
-
El sujeto debe ser exacto — una persona real, un lugar real, una obra o ilustración existente.
-
Quieres predictibilidad — el primer fotograma está fijo, así que las iteraciones solo varían el movimiento.
Consejos de prompting
Como la imagen ya se encarga del "qué", dedica tu prompt al "cómo": describe el movimiento (sutil, dramático, en bucle), la cámara (estática, avance lento, órbita) y la atmósfera que quieres desarrollar. Aquí, los prompts cortos y centrados en el movimiento suelen ganarles a las descripciones largas de escena. Más técnicas en nuestra guía para escribir prompts.
Imagen a video en Molyin
El generador Seedance 2.0 de Molyin soporta imagen a video con clips de 5 o 10 segundos, resolución de hasta 1080p, seis relaciones de aspecto, audio opcional y control de seed: sube una imagen, describe el movimiento y genera.
Términos relacionados
-
Texto a video — genera video solo a partir de un prompt escrito.
-
Referencia a video — usa imágenes como referencias de identidad en lugar de como primer fotograma literal.
Pruébalo ahora con el generador de video con IA.