Em 12 de maio de 2026, o DALL·E 2 / DALL·E 3 foi desligado na API da OpenAI (página de Deprecations da OpenAI). O sucessor, GPT Image 2 (lançado em 21 de abril), já foi atualizado para o ChatGPT Images 2.5 em 8 de setembro. O Google encerrou o Imagen 4 na Gemini API em 17 de agosto e passou a geração de imagens para o Nano Banana 2 (Gemini 3.1 Flash Image). O Midjourney tornou o V8.2 seu modelo padrão em 24 de julho, a Black Forest Labs lançou o FLUX.2, o Ideogram lançou o 4.0 com pesos abertos e o Recraft está no V4.1.

A conclusão: em setembro de 2026, nenhuma IA de imagem domina sozinha. Não é 2024, quando o Midjourney estava sozinho no topo. Nem 2023, quando o SDXL reinava no gratuito. Agora você escolhe pelo que vai criar.

Minha opinião logo de cara: se você só pode assinar uma ferramenta, escolha o Midjourney V8.2 (US$ 10/mês). Ele ainda lidera na qualidade combinada de arte e visual de marca. Para trabalho comercial com texto dentro da imagem, vá de Ideogram 4.0 ou da geração de imagens do ChatGPT (GPT Image 2.5); para fotos, Nano Banana 2 ou FLUX.2; se segurança comercial vem primeiro, Adobe Firefly. Este artigo alinha as oito principais ferramentas em setembro de 2026 e organiza forças, preços e encaixe por caso de uso com os preços oficiais de cada fornecedor (verificados em 22 de setembro de 2026).

IA DE IMAGEM · SETEMBRO 2026

8 ferramentas, 5 eixos de força — não existe mais uma única "melhor"

— Foto / Texto / Arte / Segurança comercial / Design — cada um tem seu próprio rei

FOTO
Nano Banana 2
FLUX.2
TEXTO
Ideogram 4.0
GPT Image 2.5
ARTE
Midjourney V8.2
SEGURO
Adobe Firefly
Origem dos dados publicada
DESIGN
Recraft V4.1
Saída vetorial

2024: Midjourney sozinho no topo → 2026: dividido em 5 grupos por caso de uso.
A jogada certa agora é combinar 2–3 ferramentas por propósito, não escolher apenas uma.

1. Maio de 2026: o DALL·E se aposenta — uma mudança de geração na IA de imagens

Em 12 de maio de 2026, a OpenAI desligou o DALL·E 2 e o DALL·E 3 na API (os desenvolvedores tinham sido avisados em 14 de novembro de 2025). Os substitutos indicados são os modelos GPT Image, como o gpt-image-2; o GPT Image 2 saiu em 21 de abril e chegou ao ChatGPT como "ChatGPT Images 2.0". Depois, em 8 de setembro, veio o ChatGPT Images 2.5, com dois novos modelos na API, GPT-Image-2.5 Flare e Sunburst (anúncio da OpenAI). Cerca de quatro anos depois do DALL·E 2, de 2022, é a troca de geração da ferramenta que popularizou a expressão "IA de geração de imagens".

O Google também trocou de geração. O Imagen 4 (Fast / padrão / Ultra) foi desligado na Gemini API em 17 de agosto de 2026, com o Gemini 3.1 Flash Image — apelidado de Nano Banana 2 — indicado como destino da migração (página de Deprecations da Gemini API). O Nano Banana 2 e o superior Nano Banana Pro (Gemini 3 Pro Image) ficaram disponíveis de forma geral em 28 de maio. O Midjourney foi do alpha do V8, em 17 de março, passando pelo V8.1, até tornar o V8.2 o padrão em 24 de julho.

Os outros campos também se mexeram. A Black Forest Labs lançou o FLUX.2 em novembro de 2025, com preço de API a partir de US$ 0,03 por imagem no FLUX.2 [pro]. O Ideogram lançou o 4.0 em 3 de junho e liberou o download dos pesos do modelo. O Recraft lançou o V4.1 em 14 de maio, e a Adobe já tinha o Firefly Image Model 5 em disponibilidade geral em março.

Então o trio estilo 2024 de "Midjourney, DALL·E e Stable Diffusion" não cabe mais. 2026 se dividiu em 5 grupos por caso de uso.

2. As 8 principais ferramentas em um relance

Primeiro, a visão geral. As oito principais ferramentas em setembro de 2026, com versões atuais, preços e força central.

FerramentaVersão mais recente (set. 2026)Preço (mais baixo)Força central
MidjourneyV8.2 (padrão desde julho de 2026)US$ 10/mês (Basic, 200 minutos Fast)Arte, estilização
OpenAI (ChatGPT / GPT Image)GPT Image 2.5 (setembro de 2026)Disponível no plano gratuito do ChatGPT (com limites) / API cobrada por tokensEdição fiel às instruções, layout, texto
FLUX.2 (Black Forest Labs)FLUX.2 (desde novembro de 2025)A partir de US$ 0,03/imagem ([pro], API)Fotorrealismo com bom custo, versão aberta disponível
Google Nano Banana 2Gemini 3.1 Flash Image (GA em maio de 2026)US$ 0,067/imagem (1K, Gemini API)Fotorrealismo, edição por conversa
RecraftV4.1 (maio de 2026)US$ 0,035/imagem (raster, API)Saída vetorial, sistemas de design
Ideogram4.0 (junho de 2026, pesos abertos)US$ 15/mês (Plus, cobrança anual)Texto dentro da imagem
Adobe FireflyFirefly Image Model 5US$ 9,99/mês (Standard)Segurança comercial, integração Adobe
Stable Diffusion3.5 (sem mudanças desde outubro de 2024)Grátis (GPU própria, receita anual abaixo de US$ 1 milhão)Pesos abertos, personalizável

Nota: versões e preços verificados na página oficial de cada fornecedor em 22 de setembro de 2026: Midjourney / OpenAI API · ChatGPT / Black Forest Labs / Gemini API / Recraft / Ideogram / Adobe Firefly / Stability AI

A tabela sozinha não vai decidir por você. Você precisa colocar seu próprio objetivo em palavras antes; senão nenhuma linha desta tabela vai parecer "certa". A próxima seção organiza as 8 ferramentas por eixo de força.

3. Organizadas por força — onde mirar

As mesmas 8 ferramentas, desta vez reagrupadas em 5 categorias por aquilo em que são melhores. Este é o mapa prático do campo de batalha de 2026.

5 categorias × 8 ferramentas

Matriz de seleção baseada em força

① FOTORREALISMO
Nano Banana 2 / FLUX.2
Fotos de produto, pessoas, paisagens, comida. O Nano Banana 2 funciona até no plano gratuito do app Gemini e dá para refinar conversando. O FLUX.2 [dev] tem pesos abertos, então dá para rodar localmente.
② TIPOGRAFIA DENTRO DA IMAGEM
Ideogram 4.0 / GPT Image 2.5
Logos, pôsteres, thumbnails para redes, infográficos. O Ideogram 4.0 destaca texto multilíngue e controle de posição; o GPT Image 2.5, layouts complexos e edições precisas por área.
③ ESTILIZAÇÃO ARTÍSTICA
Midjourney V8.2 / Stable Diffusion
Ilustrações, concept art, trabalho movido por atmosfera. Midjourney cobre amplitude e consistência; o SD ganha na liberdade de fine-tuning.
④ SEGURANÇA COMERCIAL
Adobe Firefly Image Model 5
A Adobe afirma que os modelos do Firefly foram treinados com conteúdo licenciado, como o Adobe Stock, mais conteúdo de domínio público. Escolha frequente para publicidade, editoras e trabalho corporativo.
⑤ VETORIAL / SISTEMAS DE DESIGN
Recraft V4.1
Saída SVG, consistência de estilo de marca, produção de ícones em escala. A geração vetorial custa US$ 0,08 por imagem via API (V4.1 Vector).

Não tente fazer tudo com uma ferramenta só. Assine 2–3 por caso de uso — essa é a resposta de 2026.
O custo total fica em torno de US$ 20–40/mês, facilmente recuperado em um único projeto.

Um olhar mais de perto: fotorrealismo com Nano Banana 2 e FLUX.2

O Google Nano Banana 2 (Gemini 3.1 Flash Image) custa US$ 0,067 por imagem 1K na Gemini API, US$ 0,101 em 2K e US$ 0,151 em 4K (página de preços da Gemini API). O superior Nano Banana Pro (Gemini 3 Pro Image) custa US$ 0,134 em 1K/2K. No app Gemini, até o plano gratuito gera imagens com o Nano Banana 2 (refazer com o Nano Banana Pro exige Google AI Plus ou superior). No Text to Image Arena da Artificial Analysis, um ranking de terceiros baseado em votos de preferência humana, o Nano Banana 2 é o modelo do Google mais bem colocado (as primeiras posições gerais são dos modelos GPT Image 2.5 da OpenAI; consultado em 22 de setembro de 2026). Atenção: o Midjourney não tem API pública, então seus modelos V8 não entram nesse ranking.

Do outro lado, o FLUX.2 (Black Forest Labs) custa a partir de US$ 0,03 por imagem via API no FLUX.2 [pro], a partir de US$ 0,07 no topo de linha [max] e a partir de US$ 0,014 no leve [klein] (página de preços da BFL). Sem assinatura mensal — só pagamento por uso via API, então para "menos de 100 imagens por mês" o FLUX.2 costuma sair bem mais barato. Além disso, o FLUX.2 [dev] tem pesos abertos que você pode rodar na própria GPU. A BFL anunciou em 23 de julho o FLUX 3, centrado em vídeo, mas a geração de imagens dele ainda não aparece na tabela pública de preços da API (verificado em 22 de setembro de 2026).

Renderização de texto: o duopólio Ideogram + GPT Image

Até 2024, "colocar texto dentro de imagens" era a maior fraqueza da IA de imagem. Ainda hoje, a documentação oficial do Midjourney diz que o texto "funciona melhor com o alfabeto latino padrão" e com palavras ou frases curtas.

Quem empurrou essa fronteira foi o Ideogram. O 4.0, de 3 de junho, destaca renderização de texto multilíngue, controle de layout por caixas para logos e títulos e saída em 2K — e publicou os pesos (anúncio do Ideogram). O GPT Image 2.5 da OpenAI, de setembro, também põe na frente layouts complexos, incluindo fundos transparentes, e edições precisas que mudam só a área indicada. Thumbnails para redes, banners de anúncio e infográficos agora são território desses dois.

4. Modelos de preço — assinatura vs. pagamento por imagem

Depois da força, a estrutura de preços é a próxima grande decisão. As ferramentas se dividem nitidamente entre mensalidade fixa e cobrança por imagem. Dependendo do volume, o custo mensal pode variar 10x.

Tipo de cobrançaFerramentas representativasMelhor para
Mensalidade fixa (ilimitada)Midjourney Standard US$ 30 (imagens ilimitadas no Relax), Adobe Firefly Standard US$ 9,99 (geração ilimitada de imagens padrão)Usuários diários; pessoas que querem iterar sem contar
Mensalidade fixa (por créditos)Midjourney Basic US$ 10 (200 minutos Fast), Ideogram Plus US$ 20 (US$ 15 na cobrança anual, 1.000 créditos/mês)Usuários leves na faixa de 100–200 imagens/mês
Pagamento por imagem (API)FLUX.2 [pro] a partir de US$ 0,03, Nano Banana 2 US$ 0,067 (1K), Recraft V4.1 US$ 0,035, Ideogram 4.0 US$ 0,03–0,10, GPT Image 2.5 por tokensIntegração em apps; picos irregulares mas de alto volume
Grátis (GPU própria / planos gratuitos)Stable Diffusion 3.5; planos gratuitos do ChatGPT e do app Gemini (com limites)Quem sabe rodar localmente; dados que não podem sair da sua rede; quem quer testar antes

Matemática concreta. Um indivíduo gerando 100 imagens/mês:

  • Midjourney Basic: US$ 10/mês (200 minutos Fast ≈ 250 gerações SD / 1.000 imagens candidatas, com folga)
  • FLUX.2 [pro]: US$ 0,03 × 100 = a partir de US$ 3/mês
  • Nano Banana 2 (1K): US$ 0,067 × 100 = US$ 6,70/mês
  • Adobe Firefly Standard: US$ 9,99/mês (2.000 créditos + geração ilimitada de imagens padrão)

Com 100 por mês, o pagamento por uso da API ganha. Olhando pelo outro lado: os US$ 10 do Midjourney Basic equivalem a cerca de 333 imagens no FLUX.2 [pro] (no piso de US$ 0,03) ou cerca de 149 no Nano Banana 2 (1K, US$ 0,067). O Midjourney devolve quatro candidatas por execução, então, se você gera muito para depois escolher, a mensalidade sai mais barata. Calcular "a partir de que volume mensal o plano ilimitado compensa" é a alfabetização em preços que você precisa em 2026.

Nota: o ChatGPT gera imagens até no plano gratuito (com limites de quantidade e velocidade, segundo a página de preços do ChatGPT); os planos pagos ampliam esses limites. Se você já paga pelo ChatGPT, tem os modelos GPT Image 2.5 sem custo adicional. O plano gratuito do app Gemini também inclui o Nano Banana 2. Essa é, possivelmente, a opção de melhor custo-benefício oculta de 2026.

5. Por caso de uso — o guia de decisão "escolha esta"

Você tem as forças e o preço. Então qual delas serve para o seu trabalho? Seis padrões comuns, com respostas diretas.

Caso de uso × Recomendação × 6

Guia de decisão "escolha esta"

① ILUSTRAÇÕES PARA BLOG / REDES SOCIAIS
→ Midjourney V8.2 Basic (US$ 10/mês)
200 minutos Fast (cerca de 250 gerações SD) bastam. Fácil manter a consistência artística e de marca. Para thumbnails com texto, combine com a geração de imagens do ChatGPT.
② LOGOS / PÔSTERES / BANNERS
→ Ideogram 4.0 (US$ 15/mês na cobrança anual) ou GPT Image 2.5
A precisão do texto decide. Para escritas não latinas (japonês, árabe etc.), teste seu texto real algumas vezes nos dois antes de decidir.
③ FOTOS DE PRODUTO PARA E-COMMERCE
→ Nano Banana 2 ou FLUX.2
Foco em fotorrealismo. Texturas de material preservadas. Para algumas centenas de imagens por mês, o FLUX.2 [pro] (a partir de US$ 0,03) é barato; se quiser refinar conversando, vá de Nano Banana 2.
④ PUBLICIDADE / EDITORIAL / CORPORATIVO
→ Adobe Firefly Image Model 5 (a partir de US$ 9,99/mês)
A Adobe declara que seus dados de treino são "conteúdo licenciado, como o Adobe Stock, mais conteúdo de domínio público". A integração com Photoshop / Illustrator também é uma grande vantagem. Atenção: os modelos de terceiros que você pode escolher dentro do Firefly (como o Nano Banana) não estão cobertos por essa declaração.
⑤ ÍCONES / SVG / DESIGN EM MASSA
→ Recraft V4.1 (US$ 0,035–0,08/imagem)
Um dos poucos modelos de IA com saída vetorial. Difícil de substituir em conjuntos de ícones de apps e na produção de peças conforme guias de marca.
⑥ DADOS CONFIDENCIAIS / INTERNOS
→ Stable Diffusion 3.5 (GPU própria)
A resposta padrão quando as imagens não podem sair da sua rede. Grátis até para uso comercial com receita anual abaixo de US$ 1 milhão (Stability AI Community License). Com uma GPU classe RTX 4090, dá para rodar localmente. LoRA permite ajustar o estilo da marca.

Minha melhor prática pessoal: Midjourney Basic (US$ 10) + a geração de imagens do ChatGPT. Comece o ChatGPT no plano gratuito e só passe para um plano pago se faltar.
Isso cobre ~80% das necessidades do dia a dia. APIs só para trabalhos comerciais pontuais que precisem de texto ou fotos.

6. Armadilhas comuns — uso comercial, direitos autorais, renderização de texto

Você escolheu por força e preço. Três armadilhas que só aparecem depois de começar a usar a ferramenta:

Armadilha ①: os termos de uso comercial variam por ferramenta

"Imagem de IA = livre para uso comercial" é um erro. As condições variam por ferramenta e plano. O Midjourney permite uso comercial em todos os planos pagos, mas empresas com receita anual acima de US$ 1 milhão precisam do Pro ou do Mega, e as gerações são públicas por padrão (o modo privado Stealth é do Pro para cima). O Adobe Firefly informa em suas perguntas frequentes que resultados de recursos sem o rótulo beta podem ser usados comercialmente. O Stable Diffusion 3.5 exige licença Enterprise para uso comercial por organizações com receita anual acima de US$ 1 milhão. A página de preços do Recraft diz que as imagens do plano gratuito pertencem ao Recraft e ficam públicas, e que a propriedade e os direitos comerciais vêm com os planos pagos. Leia sempre a cláusula de uso comercial antes de assinar.

Armadilha ②: o risco de direitos autorais varia em intensidade

O Midjourney foi processado por violação de direitos autorais pela Disney, pela Universal e outros em junho de 2025, e o caso continua em andamento em setembro de 2026 (Tribunal Distrital dos EUA para o Distrito Central da Califórnia, registro do processo). Ainda não há sentença. Para trabalho corporativo, vale saber que o Adobe Firefly descreve publicamente seus dados de treino como conteúdo licenciado mais conteúdo de domínio público. É exatamente por isso que agências de publicidade e editoras tendem ao Firefly.

Armadilha ③: texto em imagens ainda varia entre inglês e japonês

Os avanços de renderização de texto de todos os fornecedores chegam primeiro às letras latinas e aos números; japonês, chinês, árabe e outras escritas complexas ainda ficam para trás. O Midjourney diz oficialmente que favorece o alfabeto latino, o Ideogram 4.0 anuncia suporte multilíngue e a OpenAI destaca a precisão de layout no GPT Image 2.5. Para peças com texto em japonês (ou outra escrita não latina), teste seu texto real algumas vezes em cada ferramenta candidata antes de decidir. Em logos e pôsteres multilíngues, é aqui que as opções se estreitam.

Resumo

Recapitulando:

  • Maio de 2026: o DALL·E saiu da API e a geração de imagens da OpenAI passou para o GPT Image (Images 2.5 em setembro). O Google também encerrou o Imagen 4 e passou para o Nano Banana 2, e o padrão do Midjourney agora é o V8.2
  • As 8 principais ferramentas se dividem em 5 categorias de força — foto / texto / arte / segurança comercial / sistema de design.
  • O preço se divide entre mensalidade fixa e pagamento por imagem; o ponto de equilíbrio fica em torno de algumas centenas de imagens por mês.
  • Para indivíduos, a dupla Midjourney Basic (US$ 10) + geração de imagens do ChatGPT (começando pelo plano gratuito) cobre ~80% das necessidades do dia a dia.
  • Para trabalho comercial, o Adobe Firefly continua forte pela tranquilidade de sua posição pública de "treinado com dados licenciados".

A pergunta de IA de imagens em 2026 não é mais "qual é a melhor?", mas "qual serve para o meu caso de uso?" Não persiga uma solução tamanho único. Combine 2–3 ferramentas por propósito — essa é a resposta certa para um mercado que se dividiu em 5 grupos.

FAQ

Q1. Por onde devo começar?

Se você já usa o ChatGPT, pode gerar imagens na hora, até no plano gratuito (modelos GPT Image 2.5, com limites). Se não, comece pelo Midjourney Basic (US$ 10/mês). Qualquer um dos dois dá a sensação essencial da IA de imagem no primeiro mês.

Q2. Existem opções totalmente gratuitas?

O Stable Diffusion 3.5 é grátis se você rodar localmente (inclusive uso comercial com receita anual abaixo de US$ 1 milhão). Exige uma RTX 3060 ou superior e um ambiente Python. Pela praticidade, os planos gratuitos do ChatGPT e do app Gemini também geram imagens (com limites). Para opções gratuitas na nuvem, veja o Guia de Ferramentas de IA Gratuitas.

Q3. Qual é o mais seguro para uso comercial?

O Adobe Firefly é hoje o mais seguro. A Adobe descreve seus dados de treino como "conteúdo licenciado, como o Adobe Stock, mais conteúdo de domínio público". Para publicidade, editoras ou trabalho corporativo com imagens de IA, comece avaliando o Firefly. O Midjourney permite uso comercial, mas seu processo de direitos autorais com Disney, Universal e outros continua em andamento — uma decisão para cada empresa.

Q4. E quanto a dicas de prompting?

As convenções variam por ferramenta. O Midjourney prefere "sujeito, estilo, clima, composição" separados por vírgula. GPT Image / Nano Banana funcionam melhor com descrições em linguagem natural, longas e específicas, e você pode pedir "corrija só esta parte" na conversa. O Stable Diffusion aproveita bem os negative prompts (elementos a excluir). Veja também as dicas gerais de prompt.

Q5. Em que a IA de geração de vídeo é diferente?

Este artigo se concentra em ferramentas de imagem estática. A geração de vídeo segue uma trilha separada — Google Veo 3.1 / Kling 3.0 / Runway Gen-4.5 / o vídeo do Midjourney (V1) estão entre os nomes, e a Black Forest Labs anunciou em julho o FLUX 3, centrado em vídeo. O Adobe Firefly é incomum por permitir escolher esses modelos de vídeo de terceiros dentro do próprio app. Vídeo evolui ainda mais rápido que imagem estática, então espere mudanças a cada seis meses.

Relacionado: ferramentas de IA para desenvolvimento de jogos.