Texto a imagen con IA
Escribe lo que quieres ver y obtén la imagen. Nano Banana 2, GPT Image 2, Seedream 5.0, Grok Imagine 2.0 y FLUX.2 convierten una frase en portadas de revista, fotos de producto, carteles y pinturas — con texto legible, relaciones de aspecto exactas y archivos listos para publicar.
- Generaciones fallidas reembolsadas automáticamente
- Los packs de créditos nunca caducan
- El precio de cada modelo es público
- Cancela cuando quieras con un clic
- 10
- Modelos de texto a imagen
- 4K
- Resolución máxima de
- 3 cr/imagen
- Créditos desde
- 10
- Créditos gratis al registrarte
Una frase, una imagen terminada
Salidas reales de texto a imagen junto al prompt exacto que las generó — una portada de revista con tipografía serif nítida, un grano de arroz en 4K con letras grabadas, un salón neón construido a partir de una sola línea, una cascada en tinta china con caligrafía y una foto de producto de estudio. Haz Remix de cualquiera para partir de la misma configuración.

- Nano Banana 2
- Text to image
- 3:2
- 2K
Una foto de la portada satinada de una revista; la portada azul y minimalista lleva en letras grandes y en negrita las palabras Nano Banana. El texto está en una fuente serif y llena el encuadre. Sin ningún otro texto. Delante del texto hay un retrato de una persona con un vestido elegante y minimalista. Sostiene con aire juguetón el número 2, que es el punto focal. Coloca el número de edición y la fecha "Feb 2026" en la esquina, junto con un código de barras. La revista está en un estante contra una pared revocada en naranja, dentro de una tienda de diseño.

- GPT Image 2
- Text to image
- 16:9
- 4K
Un montón de arroz con miles de granos, en plano abierto. Uno de esos granos tiene grabado "GPT Image 2", justo del tamaño necesario para caber en ese único grano. Ese grano mide exactamente lo mismo que los demás, ni más grande ni más pequeño, y se integra tan bien en el montón que no se detecta a simple vista.

- Seedream 5.0 Pro
- Text to image
- 16:9
- 2K
Una habitación interior surrealista iluminada con neón, montada como un escaparate de producto desenfadado para Seedream 5.0 Pro. Vista cinematográfica en gran angular de un salón moderno y acogedor, con paredes azul intenso, tiras de LED encendidas a lo largo del suelo y de los muebles, luz de día suave que entra por unos visillos altos a la izquierda y un gran espejo de pared con marco de neón morado a la derecha. Una cabeza gigante de gato azul peludo ocupa la pared del fondo, guiña un ojo y mira una pompa de jabón transparente que flota con reflejos de colores del interior. En el centro, bloques de construcción apilados como juguetes forman una pequeña plataforma con letras 3D de colores que dicen "Seedream 5.0 Pro". Una mesa de centro azul brillante de bordes redondeados ocupa el primer plano sobre una alfombra geométrica. Añade un sillón verde con una manta verde hierba encima, una bola de lana beige cálido en el suelo, bloques de espuma abstractos esparcidos y un letrero de neón encendido con el texto "Interactive Editing" en la pared del fondo. Render 3D realista de alto detalle, ambiente de demo de producto con humor, iluminación rica en azules y morados, reflejos suaves, composición surrealista y juguetona, plano general cinematográfico.

- Grok Imagine 2.0
- Text to image
- 16:9
- high
Una pintura tradicional china de tinta aguada: un erudito con túnicas fluidas está de pie sobre un acantilado sosteniendo un bastón, contemplando una colosal cascada de varios niveles que se precipita entre la niebla; a la derecha, un pino nudoso con follaje verde azulado y bermellón. Caligrafía vertical a la izquierda con el texto 「君不见黄河之水天上来,奔流到海不复回」 y dos pequeños sellos rojos debajo. Textura de papel de arroz, pinceladas delicadas, niebla atmosférica.

- Nano Banana 2
- Text to image
- 1:1
- 1K
Una fotografía de producto en alta resolución, con luz de estudio, de una taza de café de cerámica minimalista en negro mate, presentada sobre una superficie de concreto pulido. La iluminación es un esquema de tres puntos con softbox, diseñado para crear brillos suaves y difusos y eliminar las sombras duras. El ángulo de cámara es un plano a 45 grados ligeramente elevado para lucir sus líneas limpias. Ultrarrealista, con enfoque nítido en el vapor que sube del café. Imagen cuadrada.
¿Qué es la IA de texto a imagen?
La IA de texto a imagen genera una imagen a partir de una descripción escrita. Escribes el sujeto, el estilo, la composición y la luz; el modelo renderiza una imagen nueva que coincide — sin foto de origen, sin banco de imágenes, sin necesidad de saber dibujar. La entrada del glosario sobre texto a imagen cubre el término en sí; esta página es donde generas una.
Molyin reúne todos los modelos líderes de texto a imagen en un solo estudio. Nano Banana 2 renderiza tipografía y fotos de producto hasta 4K en relaciones ultrapanorámicas; GPT Image 2 sigue instrucciones precisas y llena una página con texto editorial legible; Seedream 5.0 maneja escenas cinematográficas y composiciones densas en información; Grok Imagine 2.0 entrega infografías, carteles y estilos pictóricos a un precio fijo; la familia FLUX.2 te da dimensiones en píxeles personalizadas para impresión. Cambia de modelo en el selector y el mismo prompt se ejecuta en un motor distinto.
Texto a imagen es uno de los dos modos del generador de imágenes con IA — imagen a imagen comparte el mismo cuadro de prompt y el mismo saldo de créditos, así que una imagen terminada puede volver a usarse como referencia para la siguiente. Cada imagen se cobra por archivo, las generaciones fallidas se reembolsan, y todos los planes de pago en la página de precios incluyen derechos de uso comercial y descargas sin marca de agua. Cuando una imagen fija no basta, el generador de imagen a video la anima.
Qué modelo usar para cada imagen
Todos los modelos de texto a imagen en Molyin, con lo que hacen mejor, las resoluciones de salida que ofrecen y cuántas imágenes de referencia aceptan al cambiar a imagen a imagen.
| Modelo | Lo mejor en | Resolución | Imagen a imagen |
|---|---|---|---|
| Nano Banana 2 (Lite / Standard) | Tipografía, fotografía de producto, relaciones ultrapanorámicas hasta 8:1 | 1K / 2K / 4K (Lite: 1K) | Hasta 14 imágenes de referencia (Lite: 10) |
| Nano Banana Pro | Los renders de mayor detalle de la familia Nano Banana | 1K / 2K / 4K | Hasta 8 imágenes de referencia |
| GPT Image 2 | Seguimiento preciso de instrucciones, texto denso y legible, hasta 10 imágenes por ejecución | 1K / 2K / 4K, o tamaños exactos en píxeles hasta 3840×2160 | Hasta 16 imágenes de referencia |
| Seedream 5.0 (Pro / Lite) | Escenas cinematográficas, interfaces y composiciones densas en información | Pro 1K / 2K; Lite 2K / 3K / 4K | Hasta 10 imágenes de referencia |
| Grok Imagine 2.0 | Infografías, carteles y estilos artísticos a un precio fijo | Salida nativa, 5 relaciones de aspecto | Hasta 5 imágenes de referencia |
| FLUX.2 (Dev / Pro / Max) | Ancho y alto personalizados para impresión, detalle fotorrealista | Niveles de 0.5K–4K en Pro y Max; Dev en tamaño nativo | Hasta 8 imágenes de referencia (Dev: 5) |
Todos los modelos aquí también funcionan en modo imagen a imagen — genera una imagen desde texto y luego vuelve a usarla como referencia para refinarla.
Cómo generar una imagen a partir de texto
Tres pasos de una frase a un archivo descargable — la mayoría de las imágenes se renderizan en menos de un minuto.
Describe la imagen
Escribe primero el sujeto, luego el entorno, el estilo, la luz y la composición. Pon entre comillas cualquier palabra que deba aparecer en la imagen. Un párrafo claro vence a una lista de palabras clave.
Elige un modelo y un formato
Elige el modelo que se ajuste al trabajo, luego la relación de aspecto y la resolución. La estimación de créditos se actualiza antes de enviar, así que siempre sabes el precio de la ejecución.
Genera y descarga
La imagen llega a tu biblioteca en menos de un minuto. Descarga el archivo en resolución completa, haz Remix con un prompt ajustado para otra toma, o cambia a imagen a imagen para refinarla.
Texto a imagen vs. imagen a imagen
Los mismos modelos, distinto punto de partida: uno empieza solo con palabras, el otro con una imagen que ya tienes.
| Texto a imagen | Imagen a imagen | |
|---|---|---|
| Punto de partida | Solo una descripción escrita | Una o más imágenes de referencia más un prompt |
| Lo que controlas | Todo mediante palabras — sujeto, estilo, composición, texto | Qué se mantiene y qué cambia; la referencia define el sujeto, la composición y la paleta |
| Consistencia | Cada generación reinterpreta la descripción | El sujeto, producto o personaje se conserva desde la referencia |
| Ideal para | Conceptos nuevos, carteles, ilustraciones, primeros borradores de cualquier cosa | Variaciones de una toma existente, cambios de estilo, sustitución de producto, series de personajes |
La mayoría de los flujos de trabajo encadenan ambos: genera la primera imagen desde texto y luego refínala en imagen a imagen hasta que quede como quieres.
Créditos de texto a imagen, por imagen
Cada modelo cobra por imagen según la resolución o el nivel de calidad que elijas, y las generaciones fallidas se reembolsan automáticamente.
Con precio según resolución de salida
| Modelo | Resolución | Créditos/imagen |
|---|---|---|
| GPT Image 2 (Easy) | 1K | 8 |
| 2K | 13 | |
| 4K | 21 | |
| Nano Banana 2 Lite | 1K | 5 |
| Nano Banana 2 | 1K | 11 |
| 2K | 16 | |
| 4K | 24 | |
| Nano Banana Pro | 1K | 24 |
| 2K | 24 | |
| 4K | 32 | |
| Seedream 5.0 Lite | 2K | 8 |
| 3K | 8 | |
| 4K | 8 | |
| Seedream 5.0 Pro | 1K | 10 |
| 2K | 18 |
GPT Image 2 (Advanced) — precio según calidad y tamaño de salida
| Calidad | ≤ 1024×1024 | ≤ 2048×1024 | ≤ 2048×2048 | > 2048×2048 |
|---|---|---|---|---|
| Baja | 3 | 3 | 3 | 4 |
| Media | 11 | 11 | 11 | 11 |
| Alta | 30 | 30 | 30 | 30 |
El nivel de calidad automático se factura a la tarifa alta.
FLUX.2 — precio según tamaño de salida
| Modelo | Tamaño de salida | Créditos/imagen | Imágenes de referencia |
|---|---|---|---|
| FLUX.2 Dev | ≤ 1MP | 3 | +3 créditos/MP |
| ≤ 1.5MP | 4 | ||
| ≤ 2.1MP | 6 | ||
| FLUX.2 Pro | ≤ 0.5MP | 5 | +4 créditos/MP |
| ≤ 1MP | 7 | ||
| ≤ 2MP | 10 | ||
| ≤ 3MP | 14 | ||
| ≤ 4MP | 17 | ||
| ≤ 4.2MP | 18 | ||
| FLUX.2 Max | ≤ 0.5MP | 13 | +7 créditos/MP |
| ≤ 1MP | 16 | ||
| ≤ 2MP | 23 | ||
| ≤ 3MP | 29 | ||
| ≤ 4MP | 36 | ||
| ≤ 4.2MP | 37 |
Las imágenes de referencia de FLUX.2 se facturan por su área total real de píxeles — la columna de referencia muestra el recargo por megapíxel de entrada.
Tarifa fija por imagen
| Modelo | Créditos/imagen | Imágenes de referencia |
|---|---|---|
| Grok Imagine 2.0 | 6 | +2 créditos/imagen |
Los modelos de tarifa fija facturan lo mismo por cada salida; en las ejecuciones de imagen a imagen, cada imagen de referencia añade el recargo que se muestra arriba.
Los planes de suscripción y los paquetes de créditos de pago único se comparan en la página de precios.
Ver los precios de todos los modelos en la página de créditos
Preguntas frecuentes sobre texto a imagen con IA
Todo sobre generar imágenes desde texto en Molyin.
Empieza a crear con Molyin hoy
Regístrate gratis y convierte tu primera idea en un video cinematográfico en minutos.