Referencia a video (R2V) es una técnica de IA generativa que usa una o más imágenes de referencia para guiar la generación de video, no como primer fotograma literal, sino como ancla de identidad. El modelo estudia tus referencias (el rostro de un personaje, el diseño de un producto, un estilo artístico) y genera escenas nuevas donde esa identidad se mantiene consistente.
Referencia vs. primer fotograma
Esta es la diferencia clave con la imagen a video:
-
Imagen a video trata tu imagen como el fotograma inicial. El video empieza exactamente ahí.
-
Referencia a video trata tus imágenes como una definición de cómo se ven las cosas. El modelo puede entonces colocar ese personaje o producto en una escena, un ángulo o una acción completamente nuevos, descritos por tu prompt.
En resumen: I2V continúa una imagen; R2V la pone en escena.
Por qué importa
La consistencia es el problema más difícil del video con IA. Genera dos veces "una chica pelirroja con impermeable amarillo" solo desde texto y obtendrás dos chicas distintas. La referencia a video lo resuelve:
-
Consistencia de personaje — mantén al mismo protagonista a lo largo de tomas, escenas y episodios.
-
Fidelidad de producto — muestra tu producto real desde ángulos nuevos, en entornos nuevos.
-
Continuidad de estilo — lleva un estilo de ilustración o una imagen de marca a través de toda una serie.
Consejos de prompting
Dale al modelo referencias limpias y bien iluminadas que muestren el sujeto con claridad. Luego deja que el prompt dirija: nuevo escenario, nueva acción, nueva cámara. Di lo que debe cambiar; las referencias ya dicen lo que debe mantenerse. Más en nuestra guía para escribir prompts.
Referencia a video en Molyin
El generador Seedance 2.0 de Molyin soporta referencia a video junto con texto a video e imagen a video: clips de 5 o 10 segundos, hasta 1080p, seis relaciones de aspecto, audio opcional y control de seed.
Términos relacionados
-
Texto a video — genera solo a partir de un prompt escrito.
-
Imagen a video — anima una imagen como primer fotograma literal.
Pruébalo con el generador de video con IA.