Texto a imagen (Text-to-Image)

Texto a imagen (T2I) es una técnica de IA que convierte un prompt escrito en una imagen terminada. Aprende cómo funciona y cómo escribir buenos prompts.

Abrir el generador completo

Míralo en acción

Un prompt real y el resultado que produjo en Molyin. Pulsa Remix para empezar desde aquí.

Nano Banana 2 official sample — glossy magazine cover with bold Nano Banana serif title and a model playfully holding the number 2, crisp photoreal typography
  • Nano Banana 2
  • Text to image
  • 3:2
  • 2K

Una foto de la portada satinada de una revista; la portada azul y minimalista lleva en letras grandes y en negrita las palabras Nano Banana. El texto está en una fuente serif y llena el encuadre. Sin ningún otro texto. Delante del texto hay un retrato de una persona con un vestido elegante y minimalista. Sostiene con aire juguetón el número 2, que es el punto focal. Coloca el número de edición y la fecha "Feb 2026" en la esquina, junto con un código de barras. La revista está en un estante contra una pared revocada en naranja, dentro de una tienda de diseño.

Texto a imagen (T2I) es una técnica de IA generativa que convierte una descripción escrita —un prompt— en una imagen terminada: composición, iluminación, estilo y detalle, todo renderizado a partir de tus palabras. Tú describes la imagen; el modelo la pinta.

Cómo funciona

Los modelos modernos de texto a imagen son modelos de difusión entrenados con enormes bibliotecas de imágenes emparejadas con descripciones. La generación parte de ruido puro, y el modelo lo va "limpiando" progresivamente hasta convertirlo en una imagen, dirigido en cada paso por tu prompt. La generación más reciente combina el núcleo de difusión con un modelo de lenguaje que lee tu prompt como instrucciones y no como una bolsa de palabras clave, así que las relaciones espaciales ("la taza encima del libro"), el número de objetos e incluso el texto legible dentro de la imagen salen bien con mucha más frecuencia.

En qué destaca

El texto a imagen brilla cuando necesitas un visual y solo tienes palabras:

  • Arte conceptual y moodboards — explora estilos, paletas y composiciones antes de comprometerte con una dirección.

  • Visuales de marketing — imágenes hero, miniaturas, banners y gráficos para redes en cualquier relación de aspecto, sin sesión de fotos.

  • Ilustración a escala — genera una serie consistente fijando tu descripción de estilo y variando solo el sujeto.

Qué incluye un buen prompt

Un buen prompt de T2I se lee como el brief de un director de arte. Cubre cuatro cosas: el sujeto (qué hay en el encuadre), la composición (encuadre, perspectiva, punto focal), el estilo (medio, referencia de artista, técnica de renderizado) y la iluminación y el tono (hora dorada, neón noir, luz suave de estudio). Lo específico le gana a lo vago: "una tetera de cerámica sobre un mantel de lino, toma cenital, luz suave de ventana, fotografía de producto minimalista" supera a "una tetera bonita" todas las veces.

Preguntas sobre Texto a imagen (Text-to-Image)

¿Puedo generar imágenes gratis?

Sí. Los créditos de registro cubren tus primeras imágenes con el modelo más económico, y los precios empiezan en 3 créditos por imagen. El generador muestra el costo antes de generar.

¿Qué resoluciones y relaciones de aspecto hay disponibles?

Hasta 4K según el modelo, con relaciones de aspecto desde ultrapanorámico hasta vertical, y salida con fondo transparente en algunos modelos. El generador solo ofrece las opciones que el modelo seleccionado admite realmente.

Sigue profundizando

¿Qué es Texto a imagen (Text-to-Image)? | Molyin