El 12 de mayo de 2026, DALL·E 2 / DALL·E 3 dejaron de funcionar en la API de OpenAI (página de Deprecations de OpenAI). Su sucesor, GPT Image 2 (lanzado el 21 de abril), ya se actualizó a ChatGPT Images 2.5 el 8 de septiembre. Google cerró Imagen 4 en la Gemini API el 17 de agosto y pasó la generación de imágenes a Nano Banana 2 (Gemini 3.1 Flash Image). Midjourney hizo de V8.2 su modelo por defecto el 24 de julio, Black Forest Labs lanzó FLUX.2, Ideogram publicó 4.0 con pesos abiertos y Recraft está en V4.1.

Conclusión: en septiembre de 2026, ninguna IA de imagen domina por sí sola. Esto no es 2024, cuando Midjourney estaba solo en la cima. Tampoco 2023, cuando SDXL mandaba en lo gratuito. Ahora eliges según lo que vas a crear.

Mi opinión por delante: si solo puedes suscribirte a una herramienta, elige Midjourney V8.2 ($10/mes). Sigue liderando en calidad combinada de arte y visual de marca. Para trabajo comercial que necesita texto dentro de la imagen, Ideogram 4.0 o la generación de imágenes de ChatGPT (GPT Image 2.5); para fotos, Nano Banana 2 o FLUX.2; si la seguridad comercial es lo primero, Adobe Firefly. Este artículo alinea las ocho herramientas principales a septiembre de 2026 y ordena fortalezas, precios y encaje por caso de uso con los precios oficiales de cada proveedor (consultados el 22 de septiembre de 2026).

IA DE IMAGEN · SEPTIEMBRE 2026

8 herramientas, 5 ejes de fortaleza — ya no hay un único "mejor"

— Foto / Texto / Arte / Seguridad comercial / Diseño — cada uno tiene su propio rey

FOTO
Nano Banana 2
FLUX.2
TEXTO
Ideogram 4.0
GPT Image 2.5
ARTE
Midjourney V8.2
SEGURO
Adobe Firefly
Origen de datos publicado
DISEÑO
Recraft V4.1
Salida vectorial

2024: Midjourney sola en la cima → 2026: dividido en 5 campos por caso de uso.
La jugada correcta ahora es combinar 2–3 herramientas según el propósito, no elegir solo una.

1. Mayo de 2026: DALL·E se retira — Un cambio generacional en la IA de imagen

El 12 de mayo de 2026, OpenAI apagó DALL·E 2 y DALL·E 3 en la API (los desarrolladores habían sido avisados el 14 de noviembre de 2025). Los sustitutos indicados son los modelos GPT Image, como gpt-image-2; GPT Image 2 salió el 21 de abril y llegó a ChatGPT como "ChatGPT Images 2.0". Después, el 8 de septiembre, llegó ChatGPT Images 2.5, junto con dos modelos nuevos en la API, GPT-Image-2.5 Flare y Sunburst (anuncio de OpenAI). Unos cuatro años después de DALL·E 2 en 2022, es el relevo generacional de la herramienta que popularizó el término "IA de generación de imágenes".

Google también cambió de generación. Imagen 4 (Fast / estándar / Ultra) se cerró en la Gemini API el 17 de agosto de 2026, con Gemini 3.1 Flash Image — conocido como Nano Banana 2 — como destino de migración (página de Deprecations de la Gemini API). Nano Banana 2 y el superior Nano Banana Pro (Gemini 3 Pro Image) pasaron a disponibilidad general el 28 de mayo. Midjourney pasó de la alpha de V8 el 17 de marzo, por V8.1, a hacer de V8.2 el modelo por defecto el 24 de julio.

Los demás bandos también se movieron. Black Forest Labs lanzó FLUX.2 en noviembre de 2025, con precios de API desde $0,03 por imagen para FLUX.2 [pro]. Ideogram publicó 4.0 el 3 de junio e hizo descargables los pesos del modelo. Recraft lanzó V4.1 el 14 de mayo, y Adobe ya tenía Firefly Image Model 5 en disponibilidad general en marzo.

Así que el trío estilo 2024 de "Midjourney, DALL·E y Stable Diffusion" ya no encaja. 2026 se ha dividido en 5 campos por caso de uso.

2. Las 8 herramientas principales de un vistazo

Primero, la vista general. Ocho herramientas principales a septiembre de 2026, con versiones actuales, precios y fortaleza central.

HerramientaVersión más reciente (sept. 2026)Precio (mínimo)Fortaleza central
MidjourneyV8.2 (por defecto desde julio de 2026)$10/mes (Basic, 200 minutos Fast)Arte, estilización
OpenAI (ChatGPT / GPT Image)GPT Image 2.5 (septiembre de 2026)Disponible en el plan gratuito de ChatGPT (con límites) / API por tokensEdición fiel a las instrucciones, maquetación, texto
FLUX.2 (Black Forest Labs)FLUX.2 (desde noviembre de 2025)Desde $0,03/imagen ([pro], API)Fotorrealismo rentable, versión abierta disponible
Google Nano Banana 2Gemini 3.1 Flash Image (GA mayo de 2026)$0,067/imagen (1K, Gemini API)Fotorrealismo, edición conversacional
RecraftV4.1 (mayo de 2026)$0,035/imagen (ráster, API)Salida vectorial, sistemas de diseño
Ideogram4.0 (junio de 2026, pesos abiertos)$15/mes (Plus, facturación anual)Texto dentro de la imagen
Adobe FireflyFirefly Image Model 5$9,99/mes (Standard)Seguridad comercial, integración con Adobe
Stable Diffusion3.5 (sin cambios desde octubre de 2024)Gratis (GPU propia, menos de $1M de ingresos anuales)Pesos abiertos, personalizable

Nota: versiones y precios consultados en la página oficial de cada proveedor el 22 de septiembre de 2026: Midjourney / OpenAI API · ChatGPT / Black Forest Labs / Gemini API / Recraft / Ideogram / Adobe Firefly / Stability AI

La tabla por sí sola no decidirá por ti. Primero necesitas poner en palabras tu propio objetivo; de lo contrario, ninguna fila de esta tabla parecerá "la correcta". La siguiente sección organiza las 8 herramientas por eje de fortaleza.

3. Ordenadas por fortaleza — Hacia dónde apuntar

Las mismas 8 herramientas, esta vez reagrupadas en 5 campos según en qué destacan. Este es el mapa práctico del campo de batalla para 2026.

5 campos × 8 herramientas

Matriz de selección basada en fortaleza

① FOTORREALISMO
Nano Banana 2 / FLUX.2
Fotos de producto, personas, paisajes, comida. Nano Banana 2 funciona incluso en el plan gratuito de la app Gemini y se puede pulir conversando. FLUX.2 [dev] tiene pesos abiertos, así que puedes ejecutarlo en local.
② TIPOGRAFÍA EN IMAGEN
Ideogram 4.0 / GPT Image 2.5
Logos, pósteres, miniaturas para redes, infografías. Ideogram 4.0 presume de texto multilingüe y control de posición; GPT Image 2.5, de maquetaciones complejas y ediciones precisas por zonas.
③ ESTILIZACIÓN ARTÍSTICA
Midjourney V8.2 / Stable Diffusion
Ilustraciones, arte conceptual, trabajo guiado por atmósfera. Midjourney cubre rango y consistencia; SD gana en libertad de fine-tuning.
④ SEGURIDAD COMERCIAL
Adobe Firefly Image Model 5
Adobe afirma que los modelos de Firefly se entrenaron con contenido con licencia, como Adobe Stock, más contenido de dominio público. Opción frecuente para publicidad, editoriales y trabajo corporativo.
⑤ VECTORIAL / SISTEMAS DE DISEÑO
Recraft V4.1
Salida SVG, coherencia de estilo de marca, producción de iconos a escala. La generación vectorial cuesta $0,08 por imagen vía API (V4.1 Vector).

No intentes hacerlo todo con una sola herramienta. Suscríbete a 2–3 según el caso de uso — esa es la respuesta de 2026.
El coste total ronda los $20–40/mes, fácilmente recuperable con un solo proyecto.

Una mirada más cercana: fotorrealismo con Nano Banana 2 y FLUX.2

Google Nano Banana 2 (Gemini 3.1 Flash Image) cuesta $0,067 por imagen 1K en la Gemini API, $0,101 en 2K y $0,151 en 4K (página de precios de la Gemini API). El superior Nano Banana Pro (Gemini 3 Pro Image) cuesta $0,134 en 1K/2K. En la app Gemini, incluso el plan gratuito puede generar imágenes con Nano Banana 2 (rehacerlas con Nano Banana Pro requiere Google AI Plus o superior). En el Text to Image Arena de Artificial Analysis, un ranking de terceros basado en votos de preferencia humanos, Nano Banana 2 es el modelo de Google mejor situado (los primeros puestos generales son de los modelos GPT Image 2.5 de OpenAI; consultado el 22 de septiembre de 2026). Ojo: Midjourney no tiene API pública, así que sus modelos V8 no están en ese ranking.

Del otro lado, FLUX.2 (Black Forest Labs) cuesta desde $0,03 por imagen vía API con FLUX.2 [pro], desde $0,07 con el tope de gama [max] y desde $0,014 con el ligero [klein] (página de precios de BFL). Sin suscripción mensual: solo pago por uso vía API, así que para "menos de 100 imágenes al mes" FLUX.2 suele ganar con holgura. Además, FLUX.2 [dev] tiene pesos abiertos que puedes ejecutar en tu propia GPU. BFL anunció el 23 de julio FLUX 3, centrado en vídeo, pero su generación de imágenes aún no figura en la lista pública de precios de la API (consultado el 22 de septiembre de 2026).

Renderizado de texto: el duopolio Ideogram + GPT Image

Hasta 2024, "meter texto dentro de las imágenes" era la mayor debilidad de la IA de imagen. Incluso hoy, la documentación oficial de Midjourney dice que el texto "funciona mejor con el alfabeto latino estándar" y con palabras o frases cortas.

Quien empujó esa frontera fue Ideogram. Su versión 4.0 del 3 de junio presume de renderizado de texto multilingüe, control de maquetación con recuadros para logos y titulares y salida 2K, y publicó los pesos (anuncio de Ideogram). El GPT Image 2.5 de OpenAI, de septiembre, también pone por delante las maquetaciones complejas, incluidos fondos transparentes, y las ediciones precisas que solo cambian la zona indicada. Las miniaturas para redes, los banners publicitarios y las infografías son ahora terreno de estos dos.

4. Modelos de precios — Suscripción vs. pago por imagen

Tras la fortaleza, la estructura de precios es la siguiente gran decisión. Las herramientas se dividen claramente entre tarifa plana mensual y facturación por imagen. Dependiendo del volumen, el coste mensual puede oscilar 10x.

Tipo de facturaciónHerramientas representativasMejor para
Tarifa plana mensual (ilimitado)Midjourney Standard $30 (imágenes ilimitadas en Relax), Adobe Firefly Standard $9,99 (generación ilimitada de imágenes estándar)Usuarios diarios; gente que quiere iterar sin contar
Tarifa plana mensual (por créditos)Midjourney Basic $10 (200 minutos Fast), Ideogram Plus $20 ($15 con facturación anual, 1.000 créditos/mes)Usuarios ligeros en el rango de 100–200 imágenes/mes
Pago por imagen (API)FLUX.2 [pro] desde $0,03, Nano Banana 2 $0,067 (1K), Recraft V4.1 $0,035, Ideogram 4.0 $0,03–0,10, GPT Image 2.5 por tokensIntegración en apps; ráfagas irregulares pero de gran volumen
Gratis (GPU propia / planes gratuitos)Stable Diffusion 3.5; planes gratuitos de ChatGPT y de la app Gemini (con límites)Saber desplegar en local; datos que no pueden salir de tu red; probar sin pagar

Cuentas concretas. Un individuo generando 100 imágenes/mes:

  • Midjourney Basic: $10/mes (200 minutos Fast ≈ 250 generaciones SD / 1.000 imágenes candidatas, con margen de sobra)
  • FLUX.2 [pro]: $0,03 × 100 = desde $3/mes
  • Nano Banana 2 (1K): $0,067 × 100 = $6,70/mes
  • Adobe Firefly Standard: $9,99/mes (2.000 créditos + generación ilimitada de imágenes estándar)

Con 100 al mes gana el pago por uso de la API. Visto al revés: los $10 de Midjourney Basic equivalen a unas 333 imágenes con FLUX.2 [pro] (a su mínimo de $0,03) o unas 149 con Nano Banana 2 (1K, $0,067). Midjourney devuelve cuatro candidatas por ejecución, así que si generas mucho para luego elegir, la tarifa plana sale más barata. Calcular "a partir de qué volumen mensual compensa el plan ilimitado" es la cultura de precios que necesitas en 2026.

Nota: ChatGPT puede generar imágenes incluso en el plan gratuito (con límites de cantidad y velocidad, según la página de precios de ChatGPT); los planes de pago amplían esos límites. Si ya pagas por ChatGPT, tienes los modelos GPT Image 2.5 sin coste adicional. El plan gratuito de la app Gemini también incluye Nano Banana 2. Probablemente esa sea la mejor opción de valor oculta de 2026.

5. Por caso de uso — La guía de decisión "elige esta"

Tienes las fortalezas y los precios. Entonces, ¿cuál se ajusta a tu trabajo? Seis patrones comunes, con respuestas directas.

Caso de uso × Recomendado × 6

Guía de decisión "elige esta"

① ILUSTRACIONES PARA BLOG / REDES
→ Midjourney V8.2 Basic ($10/mes)
200 minutos Fast (unas 250 generaciones SD) bastan. Fácil mantener la coherencia artística y de marca. Para miniaturas con texto, combínalo con la generación de imágenes de ChatGPT.
② LOGOS / CARTELES / BANNERS
→ Ideogram 4.0 ($15/mes con facturación anual) o GPT Image 2.5
La precisión del texto decide. Para escrituras no latinas (japonés, árabe, etc.), prueba tu texto real varias veces en ambos antes de decidir.
③ FOTOS DE PRODUCTO PARA E-COMMERCE
→ Nano Banana 2 o FLUX.2
Enfoque en fotorrealismo. Texturas de material intactas. Para unos cientos de imágenes al mes, FLUX.2 [pro] (desde $0,03) es barato; si quieres pulir conversando, Nano Banana 2.
④ PUBLICIDAD / EDICIÓN / CORPORATIVO
→ Adobe Firefly Image Model 5 (desde $9,99/mes)
Adobe declara que sus datos de entrenamiento son "contenido con licencia, como Adobe Stock, más contenido de dominio público". La integración con Photoshop / Illustrator también es una gran ventaja. Ojo: los modelos de terceros que puedes elegir dentro de Firefly (como Nano Banana) no están cubiertos por esa declaración.
⑤ ICONOS / SVG / DISEÑO MASIVO
→ Recraft V4.1 ($0,035–0,08/imagen)
Uno de los pocos modelos de IA con salida vectorial. Difícil de sustituir para sets de iconos de apps y producción de recursos conformes a guías de marca.
⑥ DATOS CONFIDENCIALES / INTERNOS
→ Stable Diffusion 3.5 (GPU propia)
La respuesta estándar cuando las imágenes no pueden salir de tu red. Gratis incluso para uso comercial por debajo de $1M de ingresos anuales (Stability AI Community License). Con una GPU tipo RTX 4090 lo ejecutas en local. LoRA permite ajustar el estilo de marca.

Mi mejor práctica personal: Midjourney Basic ($10) + la generación de imágenes de ChatGPT. Empieza ChatGPT en el plan gratuito y pasa a uno de pago solo si te quedas corto.
Eso cubre ~80% de las necesidades diarias. APIs solo para trabajos comerciales puntuales que necesiten texto o fotos.

6. Trampas comunes — Uso comercial, derechos de autor, renderizado de texto

Elegiste por fortaleza y precio. Tres trampas que solo aparecen después de empezar a usar la herramienta:

Trampa ①: Los términos de uso comercial varían por herramienta

"Imagen de IA = libre para uso comercial" es falso. Las condiciones varían según la herramienta y el plan. Midjourney permite el uso comercial en todos los planes de pago, pero las empresas con más de $1M de ingresos anuales deben estar en Pro o Mega, y las generaciones son públicas por defecto (el modo privado Stealth es de Pro en adelante). Adobe Firefly indica en sus preguntas frecuentes que los resultados de funciones sin la etiqueta beta pueden usarse comercialmente. Stable Diffusion 3.5 exige una licencia Enterprise para el uso comercial de organizaciones con más de $1M de ingresos anuales. La página de precios de Recraft dice que las imágenes del plan gratuito son propiedad de Recraft y visibles públicamente, y que la propiedad y los derechos comerciales llegan con los planes de pago. Lee siempre la cláusula de uso comercial antes de contratar.

Trampa ②: El riesgo de derechos de autor varía en intensidad

Midjourney fue demandada por infracción de derechos de autor por Disney, Universal y otros en junio de 2025, y el caso sigue abierto en septiembre de 2026 (Tribunal de Distrito de EE. UU. para el Distrito Central de California, expediente judicial). Todavía no hay sentencia. Para trabajo corporativo, conviene saber que Adobe Firefly describe públicamente sus datos de entrenamiento como contenido con licencia más contenido de dominio público. Precisamente por eso las agencias de publicidad y las editoriales se inclinan por Firefly.

Trampa ③: el texto en imágenes sigue variando entre inglés y japonés

Las mejoras de renderizado de texto de todos los proveedores avanzan primero en letras latinas y números; el japonés, el chino, el árabe y otras escrituras complejas siguen rezagados. Midjourney dice oficialmente que favorece el alfabeto latino, Ideogram 4.0 anuncia soporte multilingüe y OpenAI destaca la precisión de maquetación en GPT Image 2.5. Para recursos con texto en japonés (u otra escritura no latina), prueba tu texto real varias veces en cada herramienta candidata antes de decidir. En logos y pósteres multilingües, aquí es donde se estrechan tus opciones.

Resumen

Recapitulando:

  • Mayo de 2026: DALL·E se retiró de la API y la generación de imágenes de OpenAI pasó a GPT Image (Images 2.5 en septiembre). Google también cerró Imagen 4 y pasó a Nano Banana 2, y el modelo por defecto de Midjourney es ahora V8.2
  • Las 8 herramientas principales se dividen en 5 campos de fortaleza — foto / texto / arte / seguridad comercial / sistema de diseño.
  • El precio se divide entre tarifa plana mensual y pago por imagen; el punto de equilibrio está en torno a unos cientos de imágenes al mes.
  • Para individuos, la combinación de Midjourney Basic ($10) + la generación de imágenes de ChatGPT (empezando por el plan gratuito) cubre ~80% de las necesidades diarias.
  • Para trabajo comercial, Adobe Firefly sigue siendo fuerte por la tranquilidad de su postura pública de "entrenado con datos con licencia".

La pregunta de la IA de imagen en 2026 ya no es "¿cuál es la mejor?" sino "¿cuál encaja con mi caso de uso?" No persigas un talle único. Combina 2–3 herramientas según el propósito — esa es la respuesta correcta para un mercado que se ha dividido en 5 campos.

Preguntas frecuentes

P1. ¿Por dónde debería empezar?

Si ya usas ChatGPT, puedes generar imágenes enseguida, incluso con el plan gratuito (modelos GPT Image 2.5, con límites). Si no, empieza por Midjourney Basic ($10/mes). Cualquiera de los dos te da la sensación esencial de la IA de imagen en el primer mes.

P2. ¿Hay opciones totalmente gratuitas?

Stable Diffusion 3.5 es gratis si lo ejecutas en local (incluido el uso comercial por debajo de $1M de ingresos anuales). Requiere una RTX 3060 o superior y un entorno Python. Por comodidad, los planes gratuitos de ChatGPT y de la app Gemini también generan imágenes (con límites). Para opciones gratuitas en la nube, consulta la Guía de herramientas de IA gratuitas.

P3. ¿Cuál es la más segura para uso comercial?

Adobe Firefly es actualmente lo más seguro. Adobe describe sus datos de entrenamiento como "contenido con licencia, como Adobe Stock, más contenido de dominio público". Para publicidad, editorial o trabajo corporativo con imágenes de IA, empieza evaluando Firefly. Midjourney permite el uso comercial, pero su demanda por derechos de autor con Disney, Universal y otros sigue abierta: una decisión que cada empresa debe tomar.

P4. ¿Qué hay de los consejos para prompts?

Las convenciones varían según la herramienta. Midjourney prefiere "sujeto, estilo, ambiente, composición" separados por comas. GPT Image / Nano Banana funcionan mejor con descripciones en lenguaje natural, largas y específicas, y puedes decirle a la imagen "arregla solo esta parte" en la conversación. Stable Diffusion aprovecha bien los negative prompts (elementos a excluir). Consulta también los consejos generales sobre prompts.

P5. ¿En qué se diferencia la IA de generación de vídeo?

Este artículo se centra en herramientas de imagen estática. La generación de vídeo va por una vía separada — Google Veo 3.1 / Kling 3.0 / Runway Gen-4.5 / el vídeo de Midjourney (V1) están entre los nombres, y Black Forest Labs anunció en julio FLUX 3, centrado en vídeo. Adobe Firefly es inusual porque permite elegir estos modelos de vídeo de terceros dentro de su app. El vídeo evoluciona aún más rápido que la imagen estática, así que espera que el panorama cambie cada seis meses.

Relacionado: herramientas de IA para desarrollo de videojuegos.