Texto a música (Text-to-Music) es IA generativa que convierte una descripción escrita en una pieza musical terminada. Describes el género, el ánimo, el tempo y los instrumentos — y, si quieres, entregas la letra — y el modelo compone, arregla, interpreta y mezcla la pista en una sola pasada. Lo que recibes no es MIDI ni un paquete de loops, sino un archivo de audio renderizado que puedes reproducir, descargar y poner en un video.
Cómo funciona
Los modelos de música se entrenan con enormes bibliotecas de audio emparejado con descripciones, así que aprenden cómo suena realmente "lo-fi hip hop cálido con un piano Rhodes polvoriento". Al generar, el modelo trabaja sobre una representación comprimida del audio en lugar de la onda cruda, lo que le permite tener en mente la estructura de toda la canción — verso, estribillo, puente — mientras renderiza instrumentos y voz a la vez. Los modelos que admiten letra alinean la línea vocal con tus palabras, de modo que el cantante canta lo que escribiste en vez de balbucear sílabas.
En qué destaca
- Bandas sonoras para video — música de fondo que sigue el ritmo y el ánimo de un clip, sin rebuscar en una biblioteca de stock.
- Canciones completas con voz — escribe la letra, nombra el estilo y recibe una pista cantada con versos y estribillo.
- Bases instrumentales — loops ambient, lo-fi, cinematográficos o electrónicos para pódcast, anuncios y videojuegos.
- Exploración rápida de estilos — prueba diez direcciones para un jingle de marca en el tiempo que antes tomaba explicarle el encargo a un compositor.
Qué incluye una buena entrada
Describe la música como un productor daría instrucciones en una sesión: género y época ("trip-hop de los 90"), ánimo ("melancólico pero esperanzador"), tempo y energía ("lento, unos 80 BPM, creciendo hacia el estribillo"), instrumentación ("guitarra acústica, batería con escobillas, bajo cálido") y voz ("contralto femenina, aireada, micrófono cercano") — o "instrumental" si no quieres ninguna. Cuando entregues la letra, marca la estructura con etiquetas como [Verse], [Chorus] y [Bridge]; el modelo las usa para dar forma al arreglo.