Texto a imagen (Text-to-Image)

July 25, 2026
Texto a imagen (T2I) es una técnica de IA que convierte un prompt escrito en una imagen terminada. Aprende cómo funciona y cómo escribir buenos prompts.
AI Image

Texto a imagen (T2I) es una técnica de IA generativa que convierte una descripción escrita —un prompt— en una imagen terminada: composición, iluminación, estilo y detalle, todo renderizado a partir de tus palabras. Tú describes la imagen; el modelo la pinta.

Cómo funciona

Los modelos modernos de texto a imagen son modelos de difusión entrenados con enormes bibliotecas de imágenes emparejadas con descripciones. La generación parte de ruido puro, y el modelo lo va "limpiando" progresivamente hasta convertirlo en una imagen, dirigido en cada paso por tu prompt. La generación más reciente combina el núcleo de difusión con un modelo de lenguaje que lee tu prompt como instrucciones y no como una bolsa de palabras clave, así que las relaciones espaciales ("la taza encima del libro"), el número de objetos e incluso el texto legible dentro de la imagen salen bien con mucha más frecuencia.

En qué destaca

El texto a imagen brilla cuando necesitas un visual y solo tienes palabras:

  • Arte conceptual y moodboards — explora estilos, paletas y composiciones antes de comprometerte con una dirección.

  • Visuales de marketing — imágenes hero, miniaturas, banners y gráficos para redes en cualquier relación de aspecto, sin sesión de fotos.

  • Ilustración a escala — genera una serie consistente fijando tu descripción de estilo y variando solo el sujeto.

Qué incluye un buen prompt

Un buen prompt de T2I se lee como el brief de un director de arte. Cubre cuatro cosas: el sujeto (qué hay en el encuadre), la composición (encuadre, perspectiva, punto focal), el estilo (medio, referencia de artista, técnica de renderizado) y la iluminación y el tono (hora dorada, neón noir, luz suave de estudio). Lo específico le gana a lo vago: "una tetera de cerámica sobre un mantel de lino, toma cenital, luz suave de ventana, fotografía de producto minimalista" supera a "una tetera bonita" todas las veces.

Texto a imagen en Molyin

El generador de imágenes de Molyin ejecuta GPT Image 2 y la familia Nano Banana (2 Lite, 2 y Pro) en modo texto a imagen, con resoluciones de hasta 4K, relaciones de aspecto desde el 21:9 ultrapanorámico —e incluso formatos de banner 8:1 en Nano Banana 2— hasta el 9:16 vertical, y salida con fondo transparente para flujos de diseño.

Términos relacionados

  • Imagen a imagen — transforma una imagen existente en lugar de partir solo de palabras.

  • Texto a video — la misma idea, extendida al movimiento.

Pruébalo con el generador de imágenes con IA.

Texto a imagen (Text-to-Image) | Molyin