Table des matières
- 1. Mai 2026 : DALL·E tire sa révérence — un changement de génération dans l'IA d'image
- 2. Les 8 outils majeurs en un coup d'œil
- 3. Triés par point fort — où viser
- 4. Modèles tarifaires — abonnement vs facturation à l'image
- 5. Par cas d'usage — le guide de décision « choisis celui-ci »
- 6. Pièges fréquents — usage commercial, droits d'auteur, rendu de texte
- Synthèse
- FAQ
Le 12 mai 2026, DALL·E 2 / DALL·E 3 ont été arrêtés dans l'API d'OpenAI (page Deprecations d'OpenAI). Leur successeur GPT Image 2 (sorti le 21 avril) a lui-même été mis à jour en ChatGPT Images 2.5 le 8 septembre. Google a arrêté Imagen 4 dans la Gemini API le 17 août et confié la génération d'images à Nano Banana 2 (Gemini 3.1 Flash Image). Midjourney a fait de V8.2 son modèle par défaut le 24 juillet, Black Forest Labs a lancé FLUX.2, Ideogram a publié 4.0 avec des poids ouverts, et Recraft en est à V4.1.
L'enseignement : en septembre 2026, plus aucune IA d'image ne domine seule. Ce n'est plus 2024, où Midjourney trônait au sommet sans rival. Ni 2023, où SDXL régnait sur le gratuit. On choisit désormais en fonction de ce qu'on fabrique.
Mon avis d'emblée : si vous ne pouvez vous abonner qu'à un seul outil, prenez Midjourney V8.2 (10 $/mois). Il reste en tête sur la qualité combinée art et visuel de marque. Pour un travail commercial avec du texte dans l'image, Ideogram 4.0 ou la génération d'images de ChatGPT (GPT Image 2.5) ; pour la photo, Nano Banana 2 ou FLUX.2 ; si la sécurité commerciale passe avant tout, Adobe Firefly. Cet article aligne les huit principaux outils en septembre 2026 et classe forces, tarifs et adéquation par usage d'après les prix officiels de chaque éditeur (vérifiés le 22 septembre 2026).
8 outils, 5 axes de force — plus aucun « meilleur » unique
— Photo / Texte / Art / Sécurité commerciale / Design — chacun a son roi
2024 : Midjourney seul au sommet →
2026 : éclatement en 5 camps par cas d'usage.
Le bon mouvement aujourd'hui : combiner 2–3 outils selon l'objectif, pas en choisir un seul.
1. Mai 2026 : DALL·E tire sa révérence — un changement de génération dans l'IA d'image
Le 12 mai 2026, OpenAI a arrêté DALL·E 2 et DALL·E 3 dans l'API (les développeurs avaient été prévenus le 14 novembre 2025). Les remplaçants indiqués sont les modèles GPT Image, comme gpt-image-2 ; GPT Image 2 est sorti le 21 avril et est arrivé dans ChatGPT sous le nom « ChatGPT Images 2.0 ». Puis, le 8 septembre, est arrivé ChatGPT Images 2.5, avec deux nouveaux modèles dans l'API, GPT-Image-2.5 Flare et Sunburst (annonce d'OpenAI). Environ quatre ans après DALL·E 2 en 2022, c'est le passage de témoin de l'outil qui a popularisé l'expression « IA de génération d'images ».
Google a aussi changé de génération. Imagen 4 (Fast / standard / Ultra) a été arrêté dans la Gemini API le 17 août 2026, avec Gemini 3.1 Flash Image — surnommé Nano Banana 2 — désigné comme cible de migration (page Deprecations de la Gemini API). Nano Banana 2 et le haut de gamme Nano Banana Pro (Gemini 3 Pro Image) sont en disponibilité générale depuis le 28 mai. Midjourney est passé de l'alpha de V8 le 17 mars, via V8.1, à V8.2 par défaut le 24 juillet.
Les autres camps ont bougé aussi. Black Forest Labs a sorti FLUX.2 en novembre 2025, avec un tarif API à partir de 0,03 $ par image pour FLUX.2 [pro]. Ideogram a publié 4.0 le 3 juin et rendu les poids du modèle téléchargeables. Recraft a sorti V4.1 le 14 mai, et Adobe avait mis Firefly Image Model 5 en disponibilité générale dès mars.
Le trio version 2024 « Midjourney, DALL·E et Stable Diffusion » ne tient donc plus. 2026 s'est éclaté en 5 camps par cas d'usage.
2. Les 8 outils majeurs en un coup d'œil
D'abord, la vue d'ensemble. Les huit outils majeurs en septembre 2026, avec versions actuelles, tarifs et point fort principal.
| Outil | Dernière version (sept. 2026) | Tarif (le plus bas) | Point fort principal |
|---|---|---|---|
| Midjourney | V8.2 (par défaut depuis juillet 2026) | 10 $/mois (Basic, 200 minutes Fast) | Art, stylisation |
| OpenAI (ChatGPT / GPT Image) | GPT Image 2.5 (septembre 2026) | Utilisable avec l'offre gratuite de ChatGPT (plafonnée) / API facturée aux tokens | Édition fidèle aux instructions, mise en page, texte |
| FLUX.2 (Black Forest Labs) | FLUX.2 (depuis novembre 2025) | À partir de 0,03 $/image ([pro], API) | Photoréalisme à bon prix, version ouverte disponible |
| Google Nano Banana 2 | Gemini 3.1 Flash Image (GA en mai 2026) | 0,067 $/image (1K, Gemini API) | Photoréalisme, édition conversationnelle |
| Recraft | V4.1 (mai 2026) | 0,035 $/image (matriciel, API) | Sortie vectorielle, design systems |
| Ideogram | 4.0 (juin 2026, poids ouverts) | 15 $/mois (Plus, facturation annuelle) | Rendu de texte dans l'image |
| Adobe Firefly | Firefly Image Model 5 | 9,99 $/mois (Standard) | Sécurité commerciale, intégration Adobe |
| Stable Diffusion | 3.5 (inchangé depuis octobre 2024) | Gratuit (GPU perso, moins de 1 million de dollars de chiffre d'affaires annuel) | Poids ouverts, personnalisable |
Note : versions et tarifs vérifiés sur la page officielle de chaque éditeur le 22 septembre 2026 : Midjourney / OpenAI API · ChatGPT / Black Forest Labs / Gemini API / Recraft / Ideogram / Adobe Firefly / Stability AI
Le tableau seul ne décidera pas pour vous. Vous devez d'abord mettre votre objectif en mots ; sinon aucune ligne de ce tableau ne paraîtra « la bonne ». La section suivante organise les 8 outils par axe de force.
3. Triés par point fort — où viser
Mêmes 8 outils, cette fois regroupés en 5 camps selon ce qu'ils font de mieux. C'est la carte de bataille pratique pour 2026.
Matrice de sélection par point fort
N'essayez pas de tout faire avec un seul outil. Abonnez-vous à 2–3 selon le cas d'usage — c'est la réponse 2026.
Le coût total tourne autour de 20–40 $/mois, facilement amorti par un seul projet.
Zoom : le photoréalisme avec Nano Banana 2 et FLUX.2
Google Nano Banana 2 (Gemini 3.1 Flash Image) coûte 0,067 $ par image 1K dans la Gemini API, 0,101 $ en 2K et 0,151 $ en 4K (page de tarifs de la Gemini API). Le haut de gamme Nano Banana Pro (Gemini 3 Pro Image) coûte 0,134 $ en 1K/2K. Dans l'app Gemini, même l'offre gratuite génère des images avec Nano Banana 2 (refaire une image avec Nano Banana Pro exige Google AI Plus ou plus). Sur le Text to Image Arena d'Artificial Analysis, un classement tiers fondé sur des votes de préférence humains, Nano Banana 2 est le modèle Google le mieux placé (les premières places du classement général reviennent aux modèles GPT Image 2.5 d'OpenAI ; consulté le 22 septembre 2026). À noter : Midjourney n'a pas d'API publique, ses modèles V8 ne figurent donc pas dans ce classement.
En face, FLUX.2 (Black Forest Labs) démarre à 0,03 $ par image via l'API pour FLUX.2 [pro], à 0,07 $ pour le haut de gamme [max] et à 0,014 $ pour le léger [klein] (page de tarifs de BFL). Pas d'abonnement mensuel — uniquement du paiement à l'usage via l'API : pour « moins de 100 images par mois », FLUX.2 l'emporte souvent largement. De plus, FLUX.2 [dev] a des poids ouverts que vous pouvez faire tourner sur votre propre GPU. BFL a annoncé le 23 juillet FLUX 3, centré sur la vidéo, mais sa génération d'images ne figure pas encore dans la grille tarifaire publique de l'API (vérifié le 22 septembre 2026).
Rendu de texte : le duopole Ideogram + GPT Image
Jusqu'en 2024, « mettre du texte dans les images » était la plus grande faiblesse de l'IA d'image. Aujourd'hui encore, la documentation officielle de Midjourney indique que le texte « fonctionne le mieux avec l'alphabet latin standard » et avec des mots ou expressions courts.
C'est Ideogram qui a repoussé cette limite. Sa version 4.0 du 3 juin met en avant le rendu de texte multilingue, le contrôle de mise en page par cadres pour placer logos et titres, et la sortie 2K — avec publication des poids (annonce d'Ideogram). Le GPT Image 2.5 d'OpenAI, en septembre, met lui aussi en avant les mises en page complexes, y compris sur fond transparent, et les retouches précises qui ne modifient que la zone indiquée. Miniatures pour les réseaux, bannières publicitaires et infographies sont désormais le terrain de ces deux-là.
4. Modèles tarifaires — abonnement vs facturation à l'image
Après le point fort, le modèle tarifaire est la grande décision suivante. Les outils se partagent nettement entre forfait mensuel et facturation à l'image. Selon le volume, la facture mensuelle peut varier d'un facteur 10.
| Type de facturation | Outils représentatifs | Convient à |
|---|---|---|
| Forfait mensuel (illimité) | Midjourney Standard 30 $ (images illimitées en Relax), Adobe Firefly Standard 9,99 $ (génération d'images standard illimitée) | Utilisateurs quotidiens ; ceux qui veulent itérer sans compter |
| Forfait mensuel (à crédits) | Midjourney Basic 10 $ (200 minutes Fast), Ideogram Plus 20 $ (15 $ en facturation annuelle, 1 000 crédits/mois) | Utilisateurs légers autour de 100–200 images/mois |
| Facturation à l'image (API) | FLUX.2 [pro] dès 0,03 $, Nano Banana 2 0,067 $ (1K), Recraft V4.1 0,035 $, Ideogram 4.0 0,03–0,10 $, GPT Image 2.5 aux tokens | Intégration applicative ; rafales irrégulières mais volumineuses |
| Gratuit (GPU perso / offres gratuites) | Stable Diffusion 3.5 ; offres gratuites de ChatGPT et de l'app Gemini (plafonnées) | Savoir déployer en local ; données qui ne peuvent pas quitter votre réseau ; envie d'essayer d'abord |
Calcul concret. Un particulier qui génère 100 images/mois :
- Midjourney Basic : 10 $/mois (200 minutes Fast ≈ 250 générations SD / 1 000 images candidates, marge confortable)
- FLUX.2 [pro] : 0,03 $ × 100 = dès 3 $/mois
- Nano Banana 2 (1K) : 0,067 $ × 100 = 6,70 $/mois
- Adobe Firefly Standard : 9,99 $/mois (2 000 crédits + génération d'images standard illimitée)
À 100 par mois, le paiement à l'usage de l'API gagne. Vu dans l'autre sens : les 10 $ de Midjourney Basic représentent environ 333 images sur FLUX.2 [pro] (à son plancher de 0,03 $) ou environ 149 sur Nano Banana 2 (1K, 0,067 $). Midjourney renvoie quatre candidates par lancement : si vous générez beaucoup pour choisir ensuite, le forfait revient moins cher. Calculer « à partir de quel volume mensuel l'illimité devient rentable » est la culture tarifaire indispensable en 2026.
5. Par cas d'usage — le guide de décision « choisis celui-ci »
Vous avez les points forts et les tarifs. Alors lequel correspond à votre travail ? Six schémas courants, avec des réponses directes.
Guide de décision « choisis celui-ci »
Ma meilleure pratique personnelle : Midjourney Basic (10 $) + la génération d'images de ChatGPT. Commencez ChatGPT avec l'offre gratuite et passez à une offre payante seulement si vous êtes à court.
Cela couvre ~80 % des besoins quotidiens. Les API uniquement pour des jobs commerciaux ponctuels qui exigent du texte ou des photos.
6. Pièges fréquents — usage commercial, droits d'auteur, rendu de texte
Vous avez choisi par point fort et par tarif. Trois pièges qui n'apparaissent qu'une fois l'outil en main :
Piège ① : les conditions d'usage commercial varient selon l'outil
« Image d'IA = libre pour un usage commercial » est une idée fausse. Les conditions varient selon l'outil et l'offre. Midjourney autorise l'usage commercial sur toutes les offres payantes, mais les entreprises de plus de 1 million de dollars de chiffre d'affaires annuel doivent prendre Pro ou Mega, et les générations sont publiques par défaut (le mode privé Stealth est réservé à Pro et au-delà). Adobe Firefly précise dans sa FAQ que les résultats des fonctions sans mention bêta peuvent être utilisés commercialement. Stable Diffusion 3.5 exige une licence Enterprise pour l'usage commercial des organisations de plus de 1 million de dollars de chiffre d'affaires annuel. La page de tarifs de Recraft indique que les images de l'offre gratuite appartiennent à Recraft et sont publiques, la propriété et les droits commerciaux venant avec les offres payantes. Lisez toujours la clause d'usage commercial avant de souscrire.
Piège ② : l'intensité du risque sur le droit d'auteur varie
Midjourney a été assigné pour contrefaçon de droits d'auteur par Disney, Universal et d'autres en juin 2025, et l'affaire est toujours en cours en septembre 2026 (tribunal fédéral de district du Centre de la Californie, dossier judiciaire). Aucun jugement n'a encore été rendu. Pour un projet d'entreprise, il faut savoir qu'Adobe Firefly décrit publiquement ses données d'entraînement comme du contenu sous licence plus du contenu du domaine public. C'est précisément pour cela que les agences de publicité et les éditeurs penchent vers Firefly.
Piège ③ : le texte dans l'image diffère toujours entre l'anglais et le japonais
Les progrès de rendu de texte de tous les éditeurs arrivent d'abord sur les lettres latines et les chiffres ; le japonais, le chinois, l'arabe et les autres écritures complexes restent à la traîne. Midjourney dit officiellement privilégier l'alphabet latin, Ideogram 4.0 revendique le multilingue et OpenAI met en avant la précision de mise en page de GPT Image 2.5. Pour des visuels avec du texte en japonais (ou dans une autre écriture non latine), testez plusieurs fois votre vrai texte dans chaque outil candidat avant de décider. Pour des logos et affiches multilingues, c'est là que vos options se resserrent.
Synthèse
Récapitulatif :
- Mai 2026 : DALL·E a quitté l'API et la génération d'images d'OpenAI est passée à GPT Image (Images 2.5 en septembre). Google a aussi arrêté Imagen 4 au profit de Nano Banana 2, et le modèle par défaut de Midjourney est désormais V8.2
- Les 8 outils majeurs se répartissent en 5 camps de force — photo / texte / art / sécurité commerciale / design system.
- Les tarifs se partagent entre forfait mensuel et facturation à l'image ; le seuil de bascule se situe autour de quelques centaines d'images par mois.
- Pour les particuliers, le duo Midjourney Basic (10 $) + génération d'images de ChatGPT (en commençant par l'offre gratuite) couvre ~80 % des besoins quotidiens.
- Pour les projets commerciaux, Adobe Firefly reste fort grâce à la tranquillité qu'apporte sa position publique « entraîné sur des données sous licence ».
La question 2026 sur l'IA d'image n'est plus « quel est le meilleur ? » mais « lequel correspond à mon cas d'usage ? » Ne courez pas après le tout-en-un. Combinez 2–3 outils selon l'objectif — c'est la bonne réponse pour un marché qui s'est éclaté en 5 camps.
FAQ
Si vous utilisez déjà ChatGPT, vous pouvez générer des images tout de suite, même avec l'offre gratuite (modèles GPT Image 2.5, plafonnés). Sinon, commencez par Midjourney Basic (10 $/mois). L'un comme l'autre vous donne la sensation essentielle de l'IA d'image dès le premier mois.
Stable Diffusion 3.5 est gratuit si vous le faites tourner en local (usage commercial compris sous 1 million de dollars de chiffre d'affaires annuel). Il faut une RTX 3060 ou mieux et un environnement Python. Pour la simplicité, les offres gratuites de ChatGPT et de l'app Gemini génèrent aussi des images (plafonnées). Pour les options gratuites dans le cloud, consultez le guide des outils IA gratuits.
Adobe Firefly est actuellement le plus sûr. Adobe décrit ses données d'entraînement comme « du contenu sous licence, comme Adobe Stock, plus du contenu du domaine public ». Pour la publicité, l'édition ou les projets d'entreprise avec des images d'IA, commencez par évaluer Firefly. Midjourney autorise l'usage commercial, mais son procès en droits d'auteur face à Disney, Universal et d'autres est toujours en cours — à chaque entreprise de trancher.
Chaque outil a ses conventions. Midjourney préfère « sujet, style, ambiance, composition » séparés par des virgules. GPT Image / Nano Banana fonctionnent mieux avec des descriptions longues et précises en langage naturel, et vous pouvez dire à l'image « corrige seulement cette partie » dans la conversation. Stable Diffusion tire bien parti des negative prompts (éléments à exclure). Voir aussi les conseils généraux de prompt.
Cet article porte surtout sur les outils d'image fixe. La génération vidéo suit une piste à part — Google Veo 3.1 / Kling 3.0 / Runway Gen-4.5 / la vidéo de Midjourney (V1) font partie des noms, et Black Forest Labs a annoncé en juillet FLUX 3, centré sur la vidéo. Adobe Firefly est atypique car il permet de choisir ces modèles vidéo tiers dans sa propre app. La vidéo évolue encore plus vite que l'image fixe : attendez-vous à ce que le paysage change tous les six mois.
À lire aussi : outils d'IA pour le développement de jeux.