Am 12. Mai 2026 wurden DALL·E 2 / DALL·E 3 in der OpenAI-API abgeschaltet (Deprecations-Seite von OpenAI). Ihr Nachfolger GPT Image 2 (erschienen am 21. April) wurde am 8. September bereits zu ChatGPT Images 2.5 aktualisiert. Google hat Imagen 4 in der Gemini API am 17. August beendet und die Bildgenerierung auf Nano Banana 2 (Gemini 3.1 Flash Image) verlagert. Midjourney machte V8.2 am 24. Juli zum Standardmodell, Black Forest Labs brachte FLUX.2, Ideogram veröffentlichte 4.0 mit offenen Gewichten, und Recraft ist bei V4.1.

Die Quintessenz: Stand September 2026 dominiert keine einzelne Bild-KI mehr. Das ist nicht 2024, als Midjourney allein an der Spitze stand. Es ist nicht 2023, als SDXL den Gratisbereich beherrschte. Heute wählt man danach, was man erstellen will.

Meine Einschätzung vorab: Wenn du nur ein Tool abonnieren kannst, nimm Midjourney V8.2 (10 USD/Monat). Bei der kombinierten Qualität von Kunst und Markenvisuals liegt es weiterhin vorn. Für kommerzielle Arbeiten mit Text im Bild: Ideogram 4.0 oder die Bildgenerierung von ChatGPT (GPT Image 2.5); für Fotos: Nano Banana 2 oder FLUX.2; wenn kommerzielle Sicherheit vorgeht: Adobe Firefly. Dieser Artikel stellt die acht wichtigsten Tools mit Stand September 2026 nebeneinander und ordnet Stärken, Preise und Einsatzzwecke anhand der offiziellen Preise der Anbieter (geprüft am 22. September 2026).

BILD-KI · SEPTEMBER 2026

8 Tools, 5 Stärke-Achsen — kein einzelnes „Bestes“ mehr

— Foto / Text / Kunst / kommerziell sicher / Design — jede Kategorie hat ihren eigenen König

FOTO
Nano Banana 2
FLUX.2
TEXT
Ideogram 4.0
GPT Image 2.5
KUNST
Midjourney V8.2
SICHER
Adobe Firefly
Datenquellen offengelegt
DESIGN
Recraft V4.1
Vektor-Output

2024: Midjourney allein an der Spitze → 2026: aufgeteilt in 5 Anwendungs-Lager.
Der richtige Schritt heute ist die Kombination von 2–3 Tools nach Zweck — nicht die Wahl eines einzigen.

1. Mai 2026: DALL·E geht in den Ruhestand — ein Generationswechsel bei Bild-KI

Am 12. Mai 2026 hat OpenAI DALL·E 2 und DALL·E 3 in der API abgeschaltet (Entwickler waren am 14. November 2025 informiert worden). Als Ersatz nennt OpenAI GPT-Image-Modelle wie gpt-image-2; GPT Image 2 erschien am 21. April und kam als „ChatGPT Images 2.0“ in ChatGPT. Am 8. September folgte ChatGPT Images 2.5, dazu zwei neue API-Modelle, GPT-Image-2.5 Flare und Sunburst (Ankündigung von OpenAI). Rund vier Jahre nach DALL·E 2 aus dem Jahr 2022 ist das der Generationswechsel des Tools, das den Begriff „Bildgenerierungs-KI“ populär gemacht hat.

Auch bei Google hat die Generation gewechselt. Imagen 4 (Fast / Standard / Ultra) wurde am 17. August 2026 in der Gemini API abgeschaltet; als Migrationsziel ist Gemini 3.1 Flash Image — genannt Nano Banana 2 — angegeben (Deprecations-Seite der Gemini API). Nano Banana 2 und das höherwertige Nano Banana Pro (Gemini 3 Pro Image) sind seit dem 28. Mai allgemein verfügbar. Midjourney ging von der V8-Alpha am 17. März über V8.1 bis dahin, dass V8.2 am 24. Juli Standard wurde.

Auch die übrigen Lager haben sich bewegt. Black Forest Labs brachte FLUX.2 im November 2025; in der API kostet FLUX.2 [pro] ab 0,03 USD pro Bild. Ideogram veröffentlichte 4.0 am 3. Juni und stellte die Modellgewichte zum Download bereit. Recraft brachte V4.1 am 14. Mai, und Adobe hatte Firefly Image Model 5 bis März allgemein verfügbar gemacht.

Das Trio von 2024 — „Midjourney, DALL·E und Stable Diffusion“ — passt also nicht mehr. 2026 hat sich in 5 Anwendungs-Lager aufgespalten.

2. Die 8 wichtigsten Tools im Überblick

Zuerst der Überblick. Acht wichtige Tools mit Stand September 2026, mit aktuellen Versionen, Preisen und Kernstärken.

ToolAktuelle Version (Sept. 2026)Preis (Einstieg)Kernstärke
MidjourneyV8.2 (Standard seit Juli 2026)10 USD/Mon. (Basic, 200 Fast-Minuten)Kunst, Stilisierung
OpenAI (ChatGPT / GPT Image)GPT Image 2.5 (September 2026)Im kostenlosen ChatGPT-Tarif nutzbar (mit Limits) / API nach TokensAnweisungstreue Bearbeitung, Layout, Text
FLUX.2 (Black Forest Labs)FLUX.2 (seit November 2025)Ab 0,03 USD/Bild ([pro], API)Günstiger Fotorealismus, offene Version verfügbar
Google Nano Banana 2Gemini 3.1 Flash Image (GA Mai 2026)0,067 USD/Bild (1K, Gemini API)Fotorealismus, Bearbeitung im Dialog
RecraftV4.1 (Mai 2026)0,035 USD/Bild (Raster, API)Vektorausgabe, Designsysteme
Ideogram4.0 (Juni 2026, offene Gewichte)15 USD/Mon. (Plus, jährliche Abrechnung)Text-Rendering im Bild
Adobe FireflyFirefly Image Model 59,99 USD/Mon. (Standard)Kommerzielle Sicherheit, Adobe-Integration
Stable Diffusion3.5 (seit Oktober 2024 unverändert)Kostenlos (eigene GPU, unter 1 Mio. USD Jahresumsatz)Offene Gewichte, anpassbar

Hinweis: Versionen und Preise am 22. September 2026 auf den offiziellen Seiten der Anbieter geprüft: Midjourney / OpenAI API · ChatGPT / Black Forest Labs / Gemini API / Recraft / Ideogram / Adobe Firefly / Stability AI

Die Tabelle allein wird die Entscheidung nicht für Sie treffen. Sie müssen zuerst Ihr eigenes Ziel in Worte fassen — sonst sieht keine Zeile dieser Tabelle „richtig“ aus. Der nächste Abschnitt ordnet die 8 Tools nach Stärke-Achse.

3. Sortiert nach Stärke — wo man hinzielen sollte

Dieselben 8 Tools, diesmal neu gruppiert in 5 Lager nach Kernstärke. Das ist die praktische Schlachtkarte für 2026.

5 Lager × 8 Tools

Auswahlmatrix nach Stärke

① FOTOREALISMUS
Nano Banana 2 / FLUX.2
Produktfotos, Personen, Landschaften, Essen. Nano Banana 2 funktioniert sogar im kostenlosen Tarif der Gemini-App, und du kannst im Dialog nachbessern. FLUX.2 [dev] hat offene Gewichte und läuft daher auch lokal.
② TYPOGRAFIE IM BILD
Ideogram 4.0 / GPT Image 2.5
Logos, Poster, Social-Thumbnails, Infografiken. Ideogram 4.0 setzt auf mehrsprachigen Text und Platzierungskontrolle, GPT Image 2.5 auf komplexe Layouts und präzise Teilbearbeitung.
③ KÜNSTLERISCHE STILISIERUNG
Midjourney V8.2 / Stable Diffusion
Illustrationen, Concept Art, stimmungsbetonte Arbeiten. Midjourney deckt Bandbreite und Konsistenz ab; SD gewinnt bei Feintuning-Freiheit.
④ KOMMERZIELL SICHER
Adobe Firefly Image Model 5
Adobe gibt an, dass die Firefly-Modelle mit lizenzierten Inhalten wie Adobe Stock sowie gemeinfreien Inhalten trainiert wurden. Häufige Wahl für Werbung, Verlage und Unternehmensprojekte.
⑤ VEKTOR / DESIGNSYSTEME
Recraft V4.1
SVG-Ausgabe, Konsistenz im Markenstil, Icon-Produktion in großem Maßstab. Vektorgenerierung kostet per API 0,08 USD pro Bild (V4.1 Vector).

Versuchen Sie nicht, alles mit einem Tool zu machen. Abonnieren Sie 2–3 nach Anwendungsfall — das ist die Antwort für 2026.
Die Gesamtkosten landen bei ca. 20–40 USD/Monat und sind über ein einziges Projekt leicht wieder hereingeholt.

Genauer Blick: Fotorealismus mit Nano Banana 2 und FLUX.2

Google Nano Banana 2 (Gemini 3.1 Flash Image) kostet in der Gemini API 0,067 USD pro 1K-Bild, 0,101 USD in 2K und 0,151 USD in 4K (Preisseite der Gemini API). Das höherwertige Nano Banana Pro (Gemini 3 Pro Image) kostet 0,134 USD in 1K/2K. In der Gemini-App kann sogar der kostenlose Tarif mit Nano Banana 2 Bilder erzeugen (Neuerstellung mit Nano Banana Pro erfordert Google AI Plus oder höher). In der Text to Image Arena von Artificial Analysis, einer Drittanbieter-Rangliste auf Basis menschlicher Präferenzstimmen, ist Nano Banana 2 Googles bestplatziertes Modell (die Spitzenplätze insgesamt belegen OpenAIs GPT-Image-2.5-Modelle; abgerufen am 22. September 2026). Beachte: Midjourney hat keine öffentliche API, daher sind seine V8-Modelle nicht in dieser Rangliste.

Auf der anderen Seite kostet FLUX.2 (Black Forest Labs) per API ab 0,03 USD pro Bild für FLUX.2 [pro], ab 0,07 USD für das Topmodell [max] und ab 0,014 USD für das leichte [klein] (Preisseite von BFL). Kein Monatsabo — reine Pay-as-you-go-Abrechnung per API, daher gewinnt FLUX.2 bei „unter 100 Bildern im Monat“ oft deutlich. Außerdem hat FLUX.2 [dev] offene Gewichte, die du auf deiner eigenen GPU betreiben kannst. BFL kündigte am 23. Juli das videozentrierte FLUX 3 an, dessen Bildgenerierung steht aber noch nicht in der öffentlichen API-Preisliste (geprüft am 22. September 2026).

Text-Rendering: das Duopol aus Ideogram + GPT Image

Bis 2024 war „Text im Bild“ die größte Schwäche der Bild-KI. Noch heute schreibt die offizielle Dokumentation von Midjourney, dass Text „am besten mit dem lateinischen Standardalphabet funktioniert“ und mit kurzen Wörtern oder Phrasen.

Verschoben hat diese Grenze Ideogram. Version 4.0 vom 3. Juni setzt auf mehrsprachiges Text-Rendering, Layout-Steuerung per Rahmen für Logos und Überschriften und 2K-Ausgabe — und veröffentlichte die Gewichte (Ankündigung von Ideogram). OpenAIs GPT Image 2.5 vom September stellt ebenfalls komplexe Layouts, auch mit transparentem Hintergrund, und präzise Bearbeitungen, die nur den angegebenen Bereich ändern, in den Vordergrund. Social-Thumbnails, Werbebanner und Infografiken sind jetzt das Revier dieser beiden.

4. Preismodelle — Abo vs. Pay-per-Image

Nach der Stärke ist die Preisstruktur die nächste große Entscheidung. Die Tools teilen sich klar in monatliche Pauschale und Pay-per-Image. Je nach Volumen können die Monatskosten um den Faktor 10 schwanken.

AbrechnungstypRepräsentative ToolsAm besten für
Monatspauschale (unbegrenzt)Midjourney Standard 30 USD (unbegrenzt Bilder in Relax), Adobe Firefly Standard 9,99 USD (unbegrenzte Generierung von Standardbildern)Tagesnutzer; wer iterieren will, ohne zu zählen
Monatspauschale (Credits)Midjourney Basic 10 USD (200 Fast-Minuten), Ideogram Plus 20 USD (15 USD bei jährlicher Abrechnung, 1.000 Credits/Monat)Gelegenheitsnutzer im Bereich von 100–200 Bildern/Monat
Pay-per-Image (API)FLUX.2 [pro] ab 0,03 USD, Nano Banana 2 0,067 USD (1K), Recraft V4.1 0,035 USD, Ideogram 4.0 0,03–0,10 USD, GPT Image 2.5 nach TokensApp-Integration; unregelmäßige, aber umfangreiche Schübe
Kostenlos (eigene GPU / Gratistarife)Stable Diffusion 3.5; Gratistarife von ChatGPT und der Gemini-App (mit Limits)Wer lokal deployen kann; Daten, die das Netzwerk nicht verlassen dürfen; wer erst ausprobieren will

Konkrete Rechnung. Eine Einzelperson, die 100 Bilder/Monat erzeugt:

  • Midjourney Basic: 10 USD/Monat (200 Fast-Minuten ≈ 250 SD-Generierungen / 1.000 Kandidatenbilder, komfortabler Spielraum)
  • FLUX.2 [pro]: 0,03 USD × 100 = ab 3 USD/Monat
  • Nano Banana 2 (1K): 0,067 USD × 100 = 6,70 USD/Monat
  • Adobe Firefly Standard: 9,99 USD/Monat (2.000 Credits + unbegrenzte Generierung von Standardbildern)

Bei 100 pro Monat gewinnt die nutzungsbasierte API. Andersherum betrachtet: Die 10 USD von Midjourney Basic entsprechen etwa 333 Bildern mit FLUX.2 [pro] (zum Mindestpreis von 0,03 USD) oder etwa 149 mit Nano Banana 2 (1K, 0,067 USD). Midjourney liefert pro Durchlauf vier Kandidaten — wer viel erzeugt und dann auswählt, fährt mit der Pauschale günstiger. Auszurechnen, „ab welchem Monatsvolumen sich der unbegrenzte Tarif lohnt“, ist die Preiskompetenz, die man 2026 braucht.

Hinweis: ChatGPT erzeugt Bilder sogar im kostenlosen Tarif (mit Limits bei Anzahl und Tempo, laut Preisseite von ChatGPT); bezahlte Tarife heben die Limits an. Wer ohnehin für ChatGPT zahlt, bekommt die GPT-Image-2.5-Modelle ohne Aufpreis. Auch der kostenlose Tarif der Gemini-App enthält Nano Banana 2. Das ist möglicherweise die versteckte beste Preis-Leistung 2026.

5. Nach Anwendungsfall — die „Nimm dieses“-Entscheidungshilfe

Sie haben die Stärken und die Preise. Welches passt nun zu Ihrer Aufgabe? Sechs typische Muster, mit direkten Antworten.

Anwendungsfall × Empfehlung × 6

„Nimm dieses“-Entscheidungshilfe

① BLOG- / SOCIAL-ILLUSTRATIONEN
→ Midjourney V8.2 Basic (10 USD/Monat)
200 Fast-Minuten (etwa 250 SD-Generierungen) reichen aus. Künstlerische und Marken-Konsistenz lassen sich leicht halten. Für Thumbnails mit Text kombiniere es mit der Bildgenerierung von ChatGPT.
② LOGOS / POSTER / BANNER
→ Ideogram 4.0 (15 USD/Monat bei jährlicher Abrechnung) oder GPT Image 2.5
Die Textgenauigkeit entscheidet. Bei nicht-lateinischen Schriften (Japanisch, Arabisch usw.) teste deinen echten Text mehrmals in beiden, bevor du dich festlegst.
③ E-COMMERCE-PRODUKTFOTOS
→ Nano Banana 2 oder FLUX.2
Fokus auf Fotorealismus. Materialtexturen bleiben erhalten. Für einige hundert Bilder im Monat ist FLUX.2 [pro] (ab 0,03 USD) günstig; wer im Dialog nachbessern will, nimmt Nano Banana 2.
④ WERBUNG / VERLAG / UNTERNEHMEN
→ Adobe Firefly Image Model 5 (ab 9,99 USD/Monat)
Adobe gibt an, dass die Trainingsdaten „lizenzierte Inhalte wie Adobe Stock sowie gemeinfreie Inhalte“ sind. Die Integration in Photoshop / Illustrator ist ebenfalls ein großer Vorteil. Beachte: Drittanbietermodelle, die du in Firefly auswählen kannst (etwa Nano Banana), fallen nicht unter diese Aussage.
⑤ ICONS / SVG / SERIENDESIGN
→ Recraft V4.1 (0,035–0,08 USD/Bild)
Eines der wenigen KI-Modelle mit Vektorausgabe. Für App-Icon-Sets und markenrichtlinienkonforme Asset-Produktion schwer zu ersetzen.
⑥ VERTRAULICHE / INTERNE DATEN
→ Stable Diffusion 3.5 (eigene GPU)
Die Standardlösung, wenn Bilder das Netzwerk nicht verlassen dürfen. Selbst kommerziell kostenlos bei unter 1 Mio. USD Jahresumsatz (Stability AI Community License). Mit einer GPU der RTX-4090-Klasse läuft es lokal. LoRA ermöglicht Feintuning auf den Markenstil.

Meine persönliche Best Practice: Midjourney Basic (10 USD) + die Bildgenerierung von ChatGPT. Starte ChatGPT im kostenlosen Tarif und wechsle nur in einen bezahlten, wenn es nicht reicht.
Das deckt ~80 % des Alltagsbedarfs ab. APIs nur für einzelne kommerzielle Aufträge, die Text oder Fotos brauchen.

6. Typische Stolperfallen — kommerzielle Nutzung, Urheberrecht, Textwiedergabe

Sie haben nach Stärke und Preis ausgewählt. Drei Fallen, die erst nach dem Start zutage treten:

Falle ①: Nutzungsbedingungen für kommerzielle Verwendung variieren je Tool

„KI-Bild = frei kommerziell nutzbar“ ist ein Irrtum. Die Bedingungen hängen von Tool und Tarif ab. Midjourney erlaubt kommerzielle Nutzung in allen bezahlten Tarifen, aber Unternehmen mit mehr als 1 Mio. USD Jahresumsatz müssen Pro oder Mega nutzen, und Generierungen sind standardmäßig öffentlich (der private Stealth-Modus ab Pro). Adobe Firefly schreibt in seinen FAQ, dass Ergebnisse von Funktionen ohne Beta-Kennzeichnung kommerziell genutzt werden dürfen. Stable Diffusion 3.5 verlangt für die kommerzielle Nutzung durch Organisationen mit mehr als 1 Mio. USD Jahresumsatz eine Enterprise-Lizenz. Laut Preisseite von Recraft gehören Bilder aus dem Gratistarif Recraft und sind öffentlich; Eigentum und kommerzielle Rechte gibt es mit den bezahlten Tarifen. Lies vor dem Abschluss immer die Klausel zur kommerziellen Nutzung.

Falle ②: Das Urheberrechtsrisiko ist unterschiedlich stark

Midjourney wurde im Juni 2025 von Disney, Universal und weiteren wegen Urheberrechtsverletzung verklagt, und das Verfahren läuft im September 2026 noch (US-Bezirksgericht für den Central District of California, Verfahrensakte). Ein Urteil gibt es noch nicht. Für Unternehmensprojekte solltest du wissen, dass Adobe Firefly seine Trainingsdaten öffentlich als lizenzierte plus gemeinfreie Inhalte beschreibt. Genau deshalb tendieren Werbeagenturen und Verlage zu Firefly.

Falle ③: Text im Bild unterscheidet sich bei Englisch und Japanisch weiterhin

Die Fortschritte beim Text-Rendering aller Anbieter kommen zuerst bei lateinischen Buchstaben und Ziffern an; Japanisch, Chinesisch, Arabisch und andere komplexe Schriften hinken hinterher. Midjourney schreibt offiziell, dass es das lateinische Alphabet bevorzugt, Ideogram 4.0 wirbt mit Mehrsprachigkeit, und OpenAI betont bei GPT Image 2.5 die Layout-Präzision. Bei Motiven mit japanischem (oder anderem nicht-lateinischem) Text teste deinen echten Text mehrmals in jedem infrage kommenden Tool, bevor du entscheidest. Bei mehrsprachigen Logos und Postern wird die Auswahl hier eng.

Fazit

Zusammenfassung:

  • Mai 2026: DALL·E wurde aus der API genommen, die Bildgenerierung von OpenAI wechselte zu GPT Image (im September Images 2.5). Google beendete ebenfalls Imagen 4 und wechselte zu Nano Banana 2, und Midjourneys Standard ist jetzt V8.2
  • Die 8 Haupt-Tools teilen sich in 5 Stärke-Lager auf — Foto / Text / Kunst / kommerziell sicher / Designsystem.
  • Die Preise teilen sich in monatliche Pauschale und Pay-per-Image; der Break-even liegt bei einigen hundert Bildern im Monat.
  • Für Einzelpersonen deckt die Kombination Midjourney Basic (10 USD) + Bildgenerierung von ChatGPT (ab dem kostenlosen Tarif) ~80 % des Alltagsbedarfs ab.
  • Für kommerzielle Arbeiten bleibt Adobe Firefly stark — dank der Beruhigung, die seine öffentliche Position „mit lizenzierten Daten trainiert“ bietet.

Die Bild-KI-Frage 2026 lautet nicht mehr „welches ist das beste?“, sondern „welches passt zu meinem Anwendungsfall?“. Jagen Sie nicht der eierlegenden Wollmilchsau hinterher. Kombinieren Sie 2–3 Tools nach Zweck — das ist die richtige Antwort für einen Markt, der sich in 5 Lager aufgespalten hat.

FAQ

Q1. Womit sollte ich anfangen?

Wenn du ChatGPT schon nutzt, kannst du sofort Bilder erzeugen, sogar im kostenlosen Tarif (GPT-Image-2.5-Modelle, mit Limits). Wenn nicht, starte mit Midjourney Basic (10 USD/Monat). Beides vermittelt dir im ersten Monat das Grundgefühl für Bild-KI.

Q2. Gibt es komplett kostenlose Optionen?

Stable Diffusion 3.5 ist kostenlos, wenn du es lokal betreibst (inklusive kommerzieller Nutzung unter 1 Mio. USD Jahresumsatz). Du brauchst eine RTX 3060 oder besser und eine Python-Umgebung. Bequemer geht es mit den Gratistarifen von ChatGPT und der Gemini-App, die ebenfalls Bilder erzeugen (mit Limits). Für kostenlose Cloud-Optionen siehe den Leitfaden zu kostenlosen KI-Tools.

Q3. Was ist am sichersten für die kommerzielle Nutzung?

Adobe Firefly ist derzeit am sichersten. Adobe beschreibt seine Trainingsdaten als „lizenzierte Inhalte wie Adobe Stock sowie gemeinfreie Inhalte“. Für Werbung, Verlage oder Unternehmensprojekte mit KI-Bildern prüfe zuerst Firefly. Midjourney erlaubt kommerzielle Nutzung, aber der Urheberrechtsstreit mit Disney, Universal und weiteren läuft noch — eine Entscheidung, die jedes Unternehmen selbst treffen muss.

Q4. Was ist mit Tipps zum Prompting?

Jedes Tool hat seine Konventionen. Midjourney bevorzugt „Motiv, Stil, Stimmung, Komposition“ durch Kommas getrennt. GPT Image / Nano Banana funktionieren besser mit langen, konkreten Beschreibungen in natürlicher Sprache, und du kannst dem Bild im Dialog sagen „ändere nur diesen Teil“. Stable Diffusion nutzt Negative Prompts (auszuschließende Elemente) gut. Siehe auch allgemeine Prompt-Tipps.

Q5. Wie unterscheidet sich Video-Generierungs-KI?

Dieser Artikel konzentriert sich auf Standbild-Tools. Videogenerierung läuft auf einer eigenen Spur — Google Veo 3.1 / Kling 3.0 / Runway Gen-4.5 / das Video von Midjourney (V1) gehören zu den Namen, und Black Forest Labs kündigte im Juli das videozentrierte FLUX 3 an. Adobe Firefly ist insofern ungewöhnlich, als es solche Videomodelle von Drittanbietern direkt in der eigenen App zur Wahl stellt. Video entwickelt sich noch schneller als Standbilder; rechne damit, dass sich das Bild alle sechs Monate verschiebt.

Verwandt: KI-Tools für die Spieleentwicklung.