Texto a video (T2V) es una técnica de IA generativa que convierte una descripción escrita —un prompt— en un clip de video con movimiento, iluminación y (en los modelos modernos) audio sincronizado. Tú describes la escena; el modelo la filma.
Cómo funciona
Por dentro, la mayoría de los modelos de texto a video son modelos de difusión entrenados con enormes bibliotecas de videos emparejados con descripciones. Durante la generación, el modelo parte de ruido puro y lo va "limpiando" progresivamente hasta convertirlo en fotogramas, guiado en cada paso por tu prompt. Como el modelo genera todos los fotogramas dentro de un mismo contexto temporal, el resultado se mantiene coherente: los objetos persisten, el movimiento fluye y la cámara se comporta como una cámara, no como una presentación de diapositivas.
En qué destaca
El texto a video brilla cuando partes de nada más que una idea:
-
Exploración de conceptos — visualiza una escena antes de comprometerte con un rodaje o un storyboard.
-
Contenido de formato corto — ganchos, B-roll, teasers de producto y clips para redes en formato vertical o panorámico.
-
Tomas imposibles — un dron atravesando el ojo de una cerradura, una ciudad hecha de cristal, un zorro en traje espacial. Si puedes describirlo, el modelo puede intentarlo.
Qué incluye un buen prompt
Los mejores prompts de T2V se leen como la nota de plano de un director, no como un deseo. Cubre cuatro cosas: el sujeto (quién o qué), la acción (qué ocurre en el tiempo), la cámara (encuadre y movimiento) y la atmósfera (iluminación, paleta, tono). Para un recorrido más a fondo, consulta nuestra guía sobre cómo escribir prompts de video con IA.
Texto a video en Molyin
El generador de Molyin ejecuta Seedance 2.0 en modo texto a video con clips de 5 o 10 segundos, resolución de hasta 1080p, seis relaciones de aspecto desde el 21:9 cinematográfico hasta el 9:16 vertical, audio generado por IA opcional y control de seed para resultados reproducibles.
Términos relacionados
-
Imagen a video — anima una imagen existente en lugar de partir solo del texto.
-
Referencia a video — guía la generación con imágenes de referencia para mantener sujetos consistentes.
Pruébalo con el generador de video con IA.