Übersicht der wichtigsten KI-Bildgeneratoren

von

Consulting Briefing

Jeden Tag ein aktuelles Thema, aus Beraterperspektive aufbereitet: Worum geht es, was bedeutet es für dich, was ist jetzt zu tun.

Hier abonnieren

Kompetenzbereiche dieses Artikels

Stand: 30. Januar 2026 · Lesezeit: etwa 26 Minuten

Übersicht der wichtigsten KI-Bildgeneratoren

Cloud-Dienste im Governance-Vergleich – Rechte, Kosten und Datenschutz auf einen Blick

Übersicht der wichtigsten KI-Bildgeneratoren

Illustration: KI-Bildgenerator-Pipeline mit Schritten Prompt, Modell und Nachweis; Person vor Monitor mit generierten Bildern

Niko sortiert den Markt: links das Raster mit den Ergebnissen, rechts die drei Fragen, an denen sich entscheidet, ob daraus ein Arbeitsmittel wird oder ein Compliance-Vorfall.

WISSEN

Das ganze Thema im Überblick:

› KI-Bildgenerierung

BERATUNG

Auswahl, Vertrag und Betrieb im Haus:

› KI-Bildgenerierung – Beratung

SCHULUNG

Das Team befähigen statt beaufsichtigen:

› KI-Bildgenerierung – Schulung

 

Die Frage kommt in Projekten fast nie so an, wie sie gemeint ist. Gefragt wird: „Welcher KI-Bildgenerator ist der beste?“ Gemeint ist: „Welchen dürfen wir einsetzen, ohne dass uns später jemand die Rechnung, die Abmahnung oder das Auditprotokoll auf den Tisch legt?“ Das sind zwei völlig verschiedene Fragen. Die erste beantwortet dir jeder Kollege gerne nach dem zweiten Kaffee, die zweite ist die, für die du bezahlt wirst.

Diese KI-Bildgeneratoren Übersicht beantwortet die zweite. Sie nimmt sich die Dienste und Modelle vor, die ihre Bilder in fremden Rechenzentren erzeugen — also alles, wofür du eine Kreditkarte brauchst statt einer Grafikkarte. Für jeden Anbieter steht hier, was er kann, was er kostet, was du mit dem Ergebnis machen darfst und wo deine Eingaben landen. Kein Ranking, keine Sternchen, keine „Top 10 Tools, die du 2026 kennen musst“. Sondern das, was in eine Entscheidungsvorlage gehört.

Ein Marktüberblick über Bildgeneratoren hat ungefähr die Halbwertszeit eines aufgeschnittenen Apfels. Deshalb sind alle Angaben hier auf den Stand September 2026 geprüft, und deshalb ist der wichtigere Teil dieses Textes nicht die Anbieterliste, sondern das Raster davor: fünf Fragen, die auch dann noch funktionieren, wenn die Hälfte der hier genannten Modellnamen Geschichte ist.

Was hier drinsteht — und was nebenan

Der Markt zerfällt in zwei Hälften, die man nur mit Schmerzen in eine Tabelle zwingt. Auf der einen Seite die Cloud: fertige Oberflächen wie Midjourney oder Adobe Firefly und Modelle, die du nur über eine Programmierschnittstelle erreichst, etwa GPT Image 2 oder Gemini 3 Pro Image. Auf der anderen Seite die lokale Generierung: Modellgewichte auf eigener Hardware, mit eigenem Strom und eigener Verantwortung.

Dieser Beitrag behandelt die erste Hälfte. Die zweite hat ihre eigene Adresse: Die 15 wichtigsten Modelle zur lokalen Bildgenerierung geht die offenen Modelle durch, die du herunterladen und selbst betreiben kannst. Wer die grundsätzliche Weggabelung noch vor sich hat, findet sie in Cloud vs. lokale KI-Bildgenerierung sortiert. Und wenn dir beim Wort „Diffusion“ noch das Bild fehlt: Basiswissen KI-Bildgenerierung: Wie Diffusion funktioniert erklärt das Verfahren, ohne dass du Mathematik brauchst. Alles zusammen hängt an der Themenseite KI-Bildgenerierung.

Frage

Hier beantwortet?

Wo sonst

Welche Cloud-Dienste gibt es, was kosten sie?

Ja, das ist der Kern dieses Beitrags

—

Darf ich das Ergebnis kommerziell nutzen?

Ja, pro Anbieter aufgeschlüsselt

—

Wo werden Prompt und Bild verarbeitet?

Ja, inklusive EU-Optionen

—

Welche offenen Modelle lohnen sich lokal?

Nein, nur als Abgrenzung

Die 15 wichtigsten Modelle zur lokalen Bildgenerierung

Welche Hardware brauche ich dafür?

Nein

KI-Bildgenerierung im Unternehmen – Die strategische Alternative zur Cloud

Wie baue ich eine Produktionsstrecke?

Nur die Cloud-Seite

Aufbau einer skalierbaren Bild-Maschine mit ComfyUI und Flux

Was bedeuten Seed, Steps, CFG?

Nein, nur wo es den Vergleich betrifft

Basiswissen KI-Bildgenerierung: Wie Diffusion funktioniert

 

FAKTEN · Was sich seit der letzten Gerätegeneration verschoben hat

Die Namen aus den Einführungsfoliensätzen von vorgestern sind zum Teil schlicht abgeschaltet. DALL·E 2 und DALL·E 3 wurden am 12. Mai 2026 aus der OpenAI-Programmierschnittstelle entfernt; auf der Microsoft-Plattform wurde dall-e-3 bereits am 4. März 2026 zurückgezogen. An ihre Stelle ist die GPT-Image-Reihe getreten, aktuell GPT Image 2 seit April 2026.

Google hat mit Gemini 3 Pro Image — intern und im Marketing als „Nano Banana Pro“ geführt — seit 18. Juni 2026 ein Modell im Angebot, das bei Text im Bild und bei Infografiken den Ton angibt. Adobe liefert seit März 2026 das Firefly Image Model 5 mit nativen vier Megapixeln aus. Und Black Forest Labs aus Freiburg hat die FLUX.2-Familie samt Preisliste veröffentlicht.

Vor allem aber: Seit dem 2. August 2026 gelten die Transparenzpflichten des EU AI Act. Das ist kein Modellthema, das ist ein Prozessthema — und es entscheidet mit darüber, welcher Anbieter für dich überhaupt in Frage kommt.

 

Der Vergleichsmaßstab: fünf Governance-Fragen

Anbieter vergleicht man nicht über Bildqualität. Bildqualität ist eine Momentaufnahme, die sich mit jedem Modellsprung dreht; wer heute am schönsten rendert, ist in sechs Monaten Zweiter. Was bleibt, sind die fünf Fragen, die dir jede Rechtsabteilung, jeder Datenschutzbeauftragte und jeder Einkauf stellen wird — nur nie alle gleichzeitig und nie in der richtigen Reihenfolge.

Infografik: Fünf Entscheidungsfragen zu KI-Bildgeneratoren – Datenweg, Rechte, Training, Nachweis und Kosten.

Das Raster für jeden Anbietervergleich. Wer alle fünf Fragen beantworten kann, hat eine Entscheidung. Wer drei beantworten kann, hat eine Meinung.

Frage 1: Wo laufen Prompt und Bild durch?

Derselbe Anbieter kann drei völlig verschiedene Antworten haben, je nachdem, durch welche Tür du kommst. Wer sich im Browser anmeldet, nutzt ein Endkundenprodukt: Konto auf eine Person, Nutzungsbedingungen statt Vertrag, Eingaben häufig zur Produktverbesserung freigegeben. Wer denselben Dienst über die Programmierschnittstelle anspricht, bekommt in der Regel andere Zusagen — kein Training auf Kundendaten, definierte Aufbewahrungsfristen, einen Auftragsverarbeitungsvertrag. Und wer das Modell über die Plattform seines Hyperscalers bezieht, arbeitet unter dem Rahmenvertrag, den die IT ohnehin schon unterschrieben hat.

Drei-Spalten-Übersicht: Datenwege Endkunden-Oberfläche, Anbieter-API und Hyperscaler-Plattform im Vergleich.

Drei Türen zum selben Modell, drei verschiedene Rechtslagen. Die Unterscheidung ist der häufigste blinde Fleck in Freigabeprozessen.

Der praktische Fallstrick: Die Abteilung testet über Tür A, die Freigabe wird für Tür A erteilt, produziert wird später über Tür B — oder umgekehrt, jemand testet sauber über die Schnittstelle und die Fachabteilung arbeitet dann doch im Browser weiter, weil das bequemer ist. Schatten-IT entsteht selten aus bösem Willen, sondern fast immer aus Bequemlichkeit mit gutem Gewissen.

Frage 2: Wem gehört das Ergebnis, und wer haftet?

Hier werden zwei Dinge regelmäßig verwechselt. Das eine ist das Nutzungsrecht, das dir der Anbieter einräumt: Praktisch alle hier besprochenen Dienste erlauben zahlenden Kunden die kommerzielle Verwendung der erzeugten Bilder und erheben selbst keinen Anspruch darauf. Das andere ist das Urheberrecht — und das entsteht an einem rein maschinell erzeugten Bild schlicht nicht, weil es an der menschlichen Schöpfung fehlt. Du darfst das Bild also verwenden, aber du kannst in der Regel niemandem verbieten, dasselbe zu tun.

Die dritte Ebene ist die Haftung für Trainingsdaten, und die ist der eigentliche Unterschied zwischen den Anbietern. Adobe stellt Kunden für Ausgaben der eigenen Firefly-Modelle von Ansprüchen Dritter frei, weil das Modell auf Adobe Stock, lizenziertem und gemeinfreiem Material trainiert wurde. Für die im selben Produkt angebotenen Partner-Modelle gilt diese Zusage ausdrücklich nicht in gleicher Weise. Und Midjourney steht seit Juni 2025 in den USA in einem Verfahren mit Disney, Universal und Warner Bros. Discovery, das sich im September 2026 noch in der Beweisaufnahme befindet, ohne Verhandlungstermin. Das ist kein Grund zur Panik, aber es ist ein Punkt für die Risikoliste.

Frage 3: Wird mit deinen Eingaben trainiert?

Faustregel: Endkundenoberflächen ja oder zumindest „behalten wir uns vor“, Programmierschnittstellen und Plattformverträge nein. Wer über Vertex AI oder die Microsoft-Plattform arbeitet, bekommt schriftlich, dass Eingaben nicht ins Training wandern, kann Regionen festlegen und in vielen Konstellationen die Speicherung ganz abschalten. Wer sich privat einen Zugang klickt, bekommt das nicht — und merkt es nicht, weil die Oberfläche identisch aussieht.

Dazu kommt ein Nebeneffekt, den Rechtsabteilungen gern übersehen und Marketingleitungen gar nicht: Bei mehreren Diensten sind erzeugte Bilder in der Grundeinstellung öffentlich sichtbar. Midjourney blendet Ergebnisse in die Community-Galerie ein, sofern du nicht den Stealth Mode nutzt, und den gibt es erst ab dem Pro-Tarif. Leonardo zeigt Ergebnisse aus dem kostenlosen Zugang öffentlich. Ein Produktentwurf, der ein halbes Jahr vor dem Launch in einer öffentlichen Galerie steht, ist keine Datenpanne im technischen Sinne. Erklär das mal der Geschäftsführung.

Frage 4: Kannst du die Entstehung belegen?

Seit dem 2. August 2026 ist Nachweisbarkeit kein Hygienefaktor mehr. Der EU AI Act verlangt in Artikel 50, dass KI-erzeugte oder KI-veränderte Inhalte maschinenlesbar gekennzeichnet werden — das ist Anbieterpflicht — und dass Inhalte, die als echte Aufnahme durchgehen könnten, für das Publikum erkennbar gemacht werden. Diese zweite Pflicht trifft dich, nicht den Anbieter. Der Bußgeldrahmen reicht bis 15 Millionen Euro oder drei Prozent des weltweiten Jahresumsatzes.

Technisch hat sich die Branche 2026 auf zwei sich ergänzende Verfahren zubewegt: das C2PA-Manifest in den Metadaten und ein unsichtbares Wasserzeichen im Bild selbst. OpenAI ist im Mai 2026 in das Steuerungsgremium von C2PA eingetreten und bettet zusätzlich zum Manifest das SynthID-Wasserzeichen von Google DeepMind ein. Google kündigte auf seiner Entwicklerkonferenz 2026 an, C2PA-Prüfung und SynthID-Erkennung direkt in Suche und Chrome zu bringen. Adobe schreibt Content Credentials seit Jahren. Midjourney tut nichts davon.

Beide Verfahren haben ihre Grenze: Metadaten überleben keinen Screenshot und keine Bildverwaltung, die beim Import aufräumt; Wasserzeichen überleben zwar mehr, sagen aber nur „von einer Maschine“ und nicht „von wem, wann, mit welchem Prompt“. Was in deinen Nachweis gehört, steht deshalb sinnvollerweise in deinem System und nicht im Bild. Details zur Erkennbarkeit stehen in KI-generierte Bilder erkennen; die regulatorische Seite habe ich in EU AI Act – was seit dem 2. August 2026 gilt ausführlicher aufgeschrieben.

WICHTIG · Die Kennzeichnung ist kein Anbietermerkmal, sondern dein Prozess

Kein Dienst dieser Welt nimmt dir die sichtbare Kennzeichnung ab. Was ein Anbieter liefern kann, ist ein Signal im Bild — was du liefern musst, ist eine nachvollziehbare Kette von der Anforderung über den Prompt bis zum veröffentlichten Motiv. Genau dafür führe ich in meinen eigenen Projekten den Katalog in UB.Dossier: Werte ändern sich, der Katalog dokumentiert sie, und am Ende steht ein Nachweis, der nicht aus dem Gedächtnis rekonstruiert wurde.

 

Frage 5: Was kostet Bild Nummer 10.000?

Drei Abrechnungsmodelle, drei völlig verschiedene Kurven. Das Sitzplatz-Abo — Midjourney, Leonardo, Ideogram — kostet pro Person und Monat und ist bei mäßiger Nutzung unschlagbar günstig, skaliert aber nicht: Zehn Leute kosten zehnmal so viel, auch wenn neun davon einmal im Quartal ein Bild brauchen. Das Credit-Modell — Adobe — deckelt den Verbrauch pro Sitzplatz und wird unangenehm, wenn jemand anfängt zu experimentieren. Und die Abrechnung pro Bild — OpenAI, Google, Black Forest Labs — ist bei kleinen Mengen fast geschenkt und bei automatisierter Massenproduktion die einzige Variante, die man überhaupt kalkulieren kann.

Die Frage nach dem Ausstieg stellt niemand beim Einkauf und jeder beim nächsten Modellwechsel. Wenn dein Bildstil an einem Anbietermodell hängt, das der Anbieter abkündigt — und das passiert, siehe die abgeschalteten DALL·E-Modelle —, dann ist dein Markenbild eine Funktion fremder Produktstrategie. Wie man dagegen arbeitet, steht in Markenkonsistente KI-generierte Bilder.

Die Anbieter im Einzelnen

Jetzt die Namen. Reihenfolge nach praktischer Relevanz im deutschen Mittelstand und Großunternehmen, nicht nach Beliebtheit auf Social Media. Alle Preise sind Listenpreise ohne Umsatzsteuer, Stand September 2026.

OpenAI: GPT Image 2

Was es ist: das Bildmodell, das in ChatGPT steckt und über die Programmierschnittstelle verfügbar ist. GPT Image 2 kam im April 2026 als Nachfolger von GPT Image 1 und 1.5. Die DALL·E-Ära ist beendet — beide Vorgängermodelle wurden am 12. Mai 2026 aus der Schnittstelle entfernt, und auch GPT Image 1 hat mit dem 23. Oktober 2026 ein Abkündigungsdatum. Wer noch Skripte mit alten Modellnamen betreibt, sollte das eher diese Woche prüfen als nächstes Quartal.

Stärken: exzellente Prompttreue, brauchbarer Text im Bild, sehr gute Bearbeitung vorhandener Bilder inklusive Gesichtserhaltung. Schwächen: Die hohe Qualitätsstufe ist teuer, und die Inhaltsfilter sind streng — was im Unternehmensumfeld meistens ein Vorteil ist, bis jemand eine Kampagne mit einem historischen Motiv umsetzen will.

Preis: rund 0,006 US-Dollar pro Bild in niedriger, 0,053 in mittlerer und 0,211 in hoher Qualitätsstufe bei 1024 × 1024 Bildpunkten. Für Endanwender läuft es über ChatGPT Plus (20 US-Dollar im Monat) oder Pro (200 US-Dollar). Compliance: über die Programmierschnittstelle mit Auftragsverarbeitungsvertrag, über die Microsoft-Plattform zusätzlich mit Regionswahl, Mandantentrennung und den Protokollen, die dein Betrieb ohnehin auswertet. C2PA-Manifest plus SynthID-Wasserzeichen sind eingebettet.

Google: Gemini 3 Pro Image („Nano Banana Pro“)

Seit 18. Juni 2026 verfügbar und in einer Disziplin derzeit konkurrenzlos: Text im Bild, und zwar in Länge, Sprache und Layout. Wer Infografiken, beschriftete Diagramme, Produktverpackungen oder mehrsprachige Anzeigen erzeugen will, findet hier das Werkzeug, für das man sonst drei Arbeitsschritte gebraucht hat. Dazu kommen feine Steuerungen: örtlich begrenzte Änderungen, Licht- und Schärfeanpassung, Kameraperspektive, Ausgabe bis 4K.

Preis: 0,134 US-Dollar pro Bild in 1K oder 2K, 0,24 US-Dollar für 4K — deutlich über dem Marktmittel, aber für die genannten Aufgaben trotzdem billiger als die Alternative aus Bildgenerierung plus Satz plus Korrekturschleife. Compliance ist die eigentliche Stärke: Über Vertex AI lässt sich die Verarbeitung auf EU-Regionen festlegen — Belgien, Niederlande, Finnland, Warschau —, es gibt Zusagen gegen Training auf Kundendaten, Mandantentrennung und Konfigurationen ohne Datenaufbewahrung. Alle Ausgaben tragen SynthID.

TIPP · Den Unterschied zwischen App und Plattform ernst nehmen

Die Gemini-App für Endanwender und Gemini über Vertex AI sind vertraglich zwei verschiedene Produkte. Die App darf in vielen Unternehmen zu Recht nicht für personenbezogene Daten genutzt werden, die Plattform sehr wohl. Nimm das in die Nutzungsrichtlinie auf, sonst diskutierst du es in jedem zweiten Projekt neu.

 

Midjourney

Ästhetisch immer noch eine Bank. V8.1 ist am 30. April 2026 erschienen und bringt schnellere Generierung, bessere Detailtreue und HD-Ausgabe in 2K; als Standardversion ist bei vielen Konten weiterhin V7 eingestellt, und V8.1 setzt ein Personalisierungsprofil voraus. Wer ein Stimmungsbild braucht, das aussieht, als hätte es jemand mit Geschmack gemacht, bekommt es hier schneller als anderswo.

Die Tarife: Basic 10, Standard 30, Pro 60 und Mega 120 US-Dollar im Monat, bei Jahreszahlung 20 Prozent günstiger. Ab Standard gibt es unbegrenzte Generierung im Relax-Modus, Stealth Mode erst ab Pro. Und: Unternehmen mit mehr als einer Million US-Dollar Bruttojahresumsatz müssen laut Nutzungsbedingungen mindestens Pro oder Mega buchen, um die kommerziellen Rechte zu behalten. Das ist keine Empfehlung, das ist eine Bedingung — und sie wird in Unternehmen regelmäßig übersehen, weil der Kollege sein privates Basic-Abo mitbringt.

WARNUNG · Midjourney ist im Unternehmensbetrieb der Sonderfall, nicht der Normalfall

Es gibt bis heute keine breit verfügbare offizielle Programmierschnittstelle. Alles, was auf dem Markt als „Midjourney-API“ verkauft wird, sind Fremdlösungen, die Oberfläche oder Bot automatisieren — und genau das untersagen die Nutzungsbedingungen. Wer darauf eine Produktionsstrecke baut, baut auf Sand mit Vertragsbruch als Fundament.

Dazu: kein Auftragsverarbeitungsvertrag für den Normalkunden, Verarbeitung in den USA, Ergebnisse ohne Stealth Mode öffentlich, keine Content Credentials, kein Nutzungsprotokoll für die Administration. Und das laufende Verfahren mit den großen US-Studios. Für Ideenskizzen ohne Kundenbezug: völlig in Ordnung. Für Kampagnenproduktion mit vertraulichem Material: schwer zu verteidigen.

 

Adobe Firefly

Firefly ist der Anbieter für alle, die vor allem eines wollen: keinen Ärger. Das Image Model 5 ist seit März 2026 allgemein verfügbar, liefert nativ vier Megapixel, kennt Referenzbilder statt Stilbeschreibung und hat mit „Harmonize“ eine Funktion, die eingesetzte Bildelemente automatisch an Licht und Schatten der Umgebung angleicht. Der Vorzug bleibt die Rechtssicherheit: Für Ausgaben der Adobe-eigenen Modelle stellt Adobe Geschäftskunden von Ansprüchen Dritter frei.

Die Tarife ohne Creative Cloud: Standard 9,99 US-Dollar mit 2.000 Credits, Pro 19,99 mit 4.000, Pro Plus 49,99 mit 10.000 und Premium 199,99 mit 50.000 Credits im Monat. Der kostenlose Zugang liefert 25 Credits und setzt ein Wasserzeichen. Wichtig für die Kalkulation: Standard-Bildgenerierung ist in allen Bezahltarifen unbegrenzt, Credits verbrauchen nur die teuren Sachen — Video, Ton, Übersetzung und die Partner-Modelle.

WARNUNG · Partner-Modelle in Firefly sind nicht mit Firefly-Modellen gleichzusetzen

Adobe bietet im selben Produkt fremde Modelle an, darunter FLUX.2 pro, Googles Nano-Banana-Reihe, Veo, Kling, Runway und Topaz. Das ist praktisch, verschiebt aber die Rechtslage: Die umfassende Adobe-Freistellung gilt der eigenen Firefly-Familie. Für Partner-Modelle greift seit dem 8. Mai 2026 eine gesonderte Zusatzdeckung, die an bestimmte Creative-Cloud-Lizenzen gebunden ist und ausdrücklich nur für allgemein verfügbare Modellstände gilt — nicht für Beta-, Vorschau- oder Frühzugangsversionen.

Praktische Konsequenz: Wenn eure Freigabe auf „wir nutzen Firefly, das ist abgesichert“ beruht, muss in der Richtlinie stehen, welche Modelle im Auswahlfeld erlaubt sind. Sonst klickt jemand aus Neugier auf das Modell mit den schöneren Ergebnissen und hebelt die Absicherung aus, für die ihr bezahlt.

 

Black Forest Labs: FLUX.2

Das Freiburger Unternehmen ist der europäische Kandidat mit dem besten Verhältnis aus Qualität, Preis und Vertragsfähigkeit — gegründet von Leuten, die vorher Stable Diffusion gebaut haben. Die FLUX.2-Familie ist gestaffelt, und die Staffelung ist ungewöhnlich ehrlich: klein 4B für 0,014 US-Dollar pro Bild, klein 9B für 0,015, pro für 0,03, flex für 0,05 und max für 0,07. Die Kosten steigen mit der Ausgabegröße in Megapixeln, und Stapelaufträge multiplizieren schlicht den Grundpreis.

Lizenzseitig ist FLUX der einzige hier besprochene Anbieter mit einem echten Doppelweg. Wer über die Schnittstelle arbeitet, hat die kommerziellen Rechte ohne Zusatzlizenz dabei. Die Klein-Modelle stehen unter Apache 2.0 — herunterladen, selbst betreiben, kommerziell nutzen, keine Gebühr. Das Dev-Modell ist in der offenen Fassung nicht für kommerzielle Nutzung freigegeben; dafür verkauft Black Forest Labs eine Selbstbetriebslizenz für 999 US-Dollar im Monat mit 100.000 Bildern inklusive und einem Cent je weiterem Bild. Wer das durchrechnet, merkt schnell, ab welcher Menge sich der Umzug in den eigenen Serverraum lohnt.

Für die Praxis relevant: FLUX-Modelle tauchen inzwischen an Stellen auf, an denen man kein separates Werkzeug mehr öffnen muss — wie das im Microsoft-Umfeld aussieht, steht in Black Forest FLUX.2 in PowerPoint und Copilot.

Ideogram

Ideogram war früh der einzige Dienst, der lesbaren Text ins Bild bekam, und ist bei typografischen Aufgaben immer noch stark — auch wenn Google ihm diese Nische streitig macht. Tarife: kostenloser Zugang, Plus 20 US-Dollar, Pro 60 US-Dollar, Team 30 US-Dollar je Person und Monat, bei Jahreszahlung 25 bis 30 Prozent günstiger. Über die Programmierschnittstelle kostet Modell 4.0 zwischen 0,03 US-Dollar (Turbo) und 0,10 US-Dollar (Quality) pro Bild; die Charakterreferenz auf Basis 3.0 schlägt mit 0,10 bis 0,20 US-Dollar zu Buche.

Das Detail, an dem Produktionsplanungen scheitern: Die Schnittstelle erlaubt standardmäßig zehn gleichzeitige Anfragen. Wer mehr braucht, verhandelt — und landet damit im vertrieblich betreuten Unternehmenstarif, der auch eigene, auf Kundenmaterial trainierte Modelle und Mengenrabatte umfasst. Deutschsprachige Beschriftungen inklusive Umlauten solltest du vorher testen statt hinterher entdecken.

Leonardo.ai

Leonardo gehört seit Juli 2024 zu Canva, und das erklärt die Positionierung: viel Werkzeugkasten, viel Oberfläche, eigene Modellfamilien — Lucid Origin, Lucid Realism, Phoenix — und die Möglichkeit, eigene Stilmodelle zu trainieren, ohne einen Server anzufassen. Der kostenlose Zugang liefert 150 Token pro Tag, die Bezahltarife liegen bei 12, 30 und 60 US-Dollar im Monat, bei Jahreszahlung bis 20 Prozent günstiger. Wer im Haus ohnehin Canva Business einsetzt, hat den Einstiegstarif praktisch schon bezahlt.

Für Unternehmen ist das die interessanteste Kombination aus „eigener Stil“ und „keine eigene Hardware“. Der Preis dafür: Dein Bildmaterial fürs Training liegt in fremder Cloud, und die Ergebnisse sind im kostenlosen Zugang öffentlich. Erst die Bezahltarife stellen privat. Wer Produktentwürfe hochlädt, sollte diesen Satz zweimal lesen.

Recraft, Stability AI und der Rest des Feldes

Recraft ist der Spezialist für Marken- und Vektorarbeit: Stilbibliotheken, Markenkonsistenz, saubere Vektorausgabe, dazu ein Unternehmenstarif mit Anmeldung über das Firmenkonto, Prüfprotokollen und Mengenpreisen. Für Icon-Sätze und Illustrationen im Hausstil ist das oft die bessere Wahl als ein Allzweckmodell.

Stability AI, einst Auslöser der ganzen Bewegung, ist heute vor allem als Lizenzgeber relevant: Die Gemeinschaftslizenz ist unterhalb einer Umsatzschwelle kostenlos, darüber wird eine Unternehmenslizenz fällig. Reve rechnet Bearbeitungen im Centbereich pro Vorgang ab, veröffentlicht aber keine belastbare eigene Preisliste pro Bild. Und quer durch das Feld gilt: Normalisiert auf ein Bild mit 1024 × 1024 Bildpunkten pendelt sich der Markt bei drei bis vier US-Cent ein — dort liegen FLUX.2 pro, Ideogram Turbo, Recraft und Googles Imagen in der Standardstufe praktisch gleichauf.

Die Übersicht in einer Tabelle. Fünf Spalten, weil das die fünf Fragen sind, die am Ende zählen. Was nicht in diese Tabelle passt, passt meistens auch nicht in die Entscheidungsvorlage.

Anbieter / Modellstand

Zugang

Preismodell

Kommerzielle Nutzung

Datenverarbeitung

OpenAI
GPT Image 2 (seit 04/2026)

Schnittstelle, ChatGPT, Microsoft-Plattform

pro Bild: 0,006 / 0,053 / 0,211 USD; ChatGPT Plus 20 USD

erlaubt, Rechte beim Nutzer; keine Freistellung

AVV über Schnittstelle; Region und Mandant über Plattform; C2PA + SynthID

Google
Gemini 3 Pro Image (seit 06/2026)

Gemini-App, Schnittstelle, Vertex AI

pro Bild: 0,134 USD (1K/2K), 0,24 USD (4K)

erlaubt, Rechte beim Nutzer; keine Freistellung

EU-Regionen über Vertex AI, kein Training auf Kundendaten, SynthID

Midjourney
V7 Standard, V8.1 seit 04/2026

Web und Discord; keine offizielle Schnittstelle

Abo 10 / 30 / 60 / 120 USD, jährlich −20 %

erlaubt ab Bezahltarif; ab 1 Mio. USD Umsatz Pro oder Mega Pflicht

USA, kein AVV im Standard; ohne Stealth Mode öffentlich; keine Nachweise

Adobe Firefly
Image Model 5 (seit 03/2026)

Firefly Web, Creative Cloud, Unternehmensprodukte

Abo 9,99 / 19,99 / 49,99 / 199,99 USD; Standardbilder unbegrenzt

erlaubt; Freistellung für Adobe-Modelle, nicht für Partner-Modelle

AVV, Unternehmensverwaltung, Content Credentials serienmäßig

Black Forest Labs
FLUX.2 (klein / pro / flex / max)

BFL-Schnittstelle, Partnerplattformen, Selbstbetrieb

pro Bild: 0,014 bis 0,07 USD; Selbstbetrieb Dev 999 USD/Monat

über Schnittstelle voll enthalten; klein unter Apache 2.0

Anbieter in Deutschland, EU-Recht, AVV; Selbstbetrieb ohne Datenabfluss

Ideogram
Modell 4.0

Web, Schnittstelle

Abo 20 / 60 / 30 USD je Person; pro Bild 0,03 bis 0,20 USD

erlaubt, Rechte beim Nutzer

USA; Unternehmenskonditionen über Vertrieb; 10 parallele Anfragen

Leonardo.ai
(Canva), Lucid-Familie

Web, Schnittstelle

Abo 12 / 30 / 60 USD; kostenlos 150 Token pro Tag

erlaubt, Rechte beim Nutzer

Cloud; privat erst ab Bezahltarif; eigene Stilmodelle möglich

Recraft / Stability AI
Spezialisten

Web, Schnittstelle

pro Bild bzw. Credits; Stability unter Umsatzschwelle kostenlos

erlaubt; Stability mit Umsatzschwelle

Recraft mit Unternehmenstarif inkl. Anmeldeverbund und Prüfprotokoll

 

Preise, ehrlich gerechnet

Preisvergleiche in diesem Markt sind Vergleiche von Äpfeln mit Fahrradschlössern. Der eine rechnet pro Bild, der andere pro Sitzplatz, der dritte pro Credit, und niemand meint mit „ein Bild“ dasselbe. Trotzdem lässt sich ein Teil normalisieren: Preis für ein Bild mit 1024 × 1024 Bildpunkten in der jeweils ausgewiesenen Qualitätsstufe.

Balkendiagramm: Preis pro KI-generiertem Bild in USD für FLUX.2, GPT Image 2, Ideogram 4.0 und Gemini 3 Pro Image.

Der Faktor zwischen der günstigsten und der teuersten Cloud-Generierung liegt bei rund siebzehn. Bei 10.000 Bildern im Monat sind das 140 gegenüber 2.400 US-Dollar.

Was die Grafik nicht zeigt und was in jeder Kalkulation fehlt: den Ausschuss. In der Praxis brauchst du je nach Anspruch drei bis zehn Generierungen, bis ein Motiv sitzt. Rechne also nicht mit der Zahl der veröffentlichten Bilder, sondern mit der Zahl der erzeugten. Wer das nicht tut, präsentiert im Lenkungskreis eine Zahl, die um den Faktor fünf danebenliegt — und zwar nach unten, was die unangenehmere Richtung ist.

Abrechnungsart

Wer

Gut bei

Wird teuer, wenn

Beispielrechnung bei 5.000 Bildern/Monat

Sitzplatz-Abo

Midjourney, Leonardo, Ideogram

wenigen Personen mit hoher Nutzung

viele Gelegenheitsnutzer Sitzplätze belegen

Midjourney Pro: 60 USD je Person — aber ohne Automatisierung

Credits

Adobe Firefly

gemischten Kreativ-Arbeitsplätzen

Video, Ton oder Partner-Modelle mitlaufen

Firefly Pro 19,99 USD je Person; Standardbilder unbegrenzt

Preis pro Bild

OpenAI, Google, Black Forest Labs

Automatisierung und Massenproduktion

hohe Qualitätsstufe zur Gewohnheit wird

FLUX.2 pro: 150 USD · GPT Image 2 hoch: 1.055 USD · Gemini 4K: 1.200 USD

Selbstbetriebslizenz

Black Forest Labs (Dev)

sehr großen, gleichförmigen Mengen

die Auslastung unter der Schwelle bleibt

999 USD/Monat pauschal — lohnt erst deutlich jenseits 30.000 Bildern

 

TIPP · Erst den Ausschuss messen, dann den Anbieter wählen

Nimm zwanzig echte Aufgaben aus deinem Alltag, nicht zwanzig hübsche Testprompts. Zähle, wie viele Generierungen bis zum verwendbaren Ergebnis nötig waren, und rechne die Anbieterpreise darauf hoch. In den meisten Projekten kippt das Ergebnis dabei — das scheinbar teure Modell mit besserer Prompttreue kostet am Ende weniger als das billige mit vier Anläufen. Warum Modelle Anweisungen ignorieren, steht in Warum die KI den Prompt ignoriert; wie man Prompts so baut, dass sie treffen, in Prompt und Negativ-Prompt in der KI-Bildgenerierung.

 

Die Kostenfrage kippt irgendwann in eine Architekturfrage. Ab welcher Menge sich der eigene Betrieb rechnet, hängt an drei Größen: Bildmenge, Personalkosten für den Betrieb und dem Wert der Datenhoheit. Die ausführliche Gegenrechnung steht in KI-Bildgenerierung im Unternehmen – Die strategische Alternative zur Cloud, die technische Umsetzung in Aufbau einer skalierbaren Bild-Maschine mit ComfyUI und Flux.

Einordnung: Welcher Dienst für welchen Fall

Die ehrlichste Antwort auf „Welchen nehmen wir?“ lautet: mehr als einen, aber weniger als vier. Ein einziger Dienst deckt selten alle Aufgaben ab, und ein Werkzeugkasten mit acht Zugängen ist kein Werkzeugkasten, sondern eine Beschaffungsakte mit acht Vertragslücken.

Aufgabe im Haus

Naheliegende Wahl

Warum

Stimmungsbilder, frühe Entwürfe, Moodboards

Midjourney oder Leonardo

Geschwindigkeit und Ästhetik schlagen hier alles; keine Kundendaten im Spiel

Grafiken mit Beschriftung, Infografiken, Verpackung

Gemini 3 Pro Image, alternativ Ideogram

Text im Bild funktioniert verlässlich, auch mehrsprachig

Kampagnenmaterial mit Freigabepflicht

Adobe Firefly (Adobe-Modelle)

Freistellung, Content Credentials, Administration und Nachweise ab Werk

Automatisierte Massenproduktion

FLUX.2 über Schnittstelle, GPT Image 2

Abrechnung pro Bild, belastbare Schnittstelle, planbare Mengen

Vertrauliches Material, Produktentwürfe

FLUX.2 im Selbstbetrieb oder Modell im eigenen Mandanten

kein Datenabfluss; Nachweis vollständig in eigener Hand

Icons, Vektoren, Hausstil

Recraft

auf Markenkonsistenz und saubere Vektorausgabe ausgelegt

Bildbearbeitung an vorhandenem Material

GPT Image 2 oder FLUX.2 mit Bildeingabe

starke Bearbeitung inklusive Erhaltung vorhandener Bildteile

 

Was du zusätzlich brauchst, egal welcher Anbieter

Drei Dinge entscheiden darüber, ob aus einem Zugang ein Arbeitsmittel wird. Erstens eine Ablage, die weiß, woher ein Bild kommt — Prompt, Modell, Modellstand, Datum, Verantwortliche. Wie man das mit Bordmitteln baut, steht in Digital Asset Management für KI-Bilder mit SharePoint Online und Power Platform. Zweitens eine Regel, welche Motive überhaupt erzeugt werden dürfen und welche nicht; die Diskussion über realistisch wirkende Personen führt man besser vorher als nachher. Drittens ein Team, das versteht, was es tut — sonst kaufst du Rechenzeit und bekommst Frustration. Genau dafür gibt es die KI-Bildgenerierung – Schulung.

Für den Produktionsteil setze ich UB.Forge ein: Der Workflow ändert sich, die Produktion muss trotzdem laufen, und vor der Veröffentlichung steht ein Plausibilitäts-Check — also die Frage, ob das erzeugte Bild fachlich überhaupt stimmen kann. Ein Maschinenraum mit sechs Fingern an einer Hand ist kein Stilmittel, sondern ein Rückruf beim Kunden. Warum das ausgerechnet Hände so oft trifft, steht in Warum KI keine Hände kann.

Wer die Auswahl nicht allein treffen will oder muss: Genau diese Bewertung — Anbieter, Vertrag, Datenweg, Nachweis, Kosten — ist der Inhalt meiner KI-Bildgenerierung – Beratung. Und weil die Frage regelmäßig kommt: Ja, ich setze das selbst ein, was ich hier beschreibe; nachzulesen in Dogfooding: Ich setze ein, was ich berate. Wenn die Bildproduktion Teil einer größeren Agentenstrecke werden soll, ist Claude im Unternehmen der passende Einstiegspunkt.

Fazit

Der Markt hat sich 2026 sortiert, und zwar nicht nach Bildqualität, sondern nach Geschäftsmodell. Oben stehen die drei Plattformanbieter, die Bild als Funktion ihrer großen Modelle mitliefern — OpenAI, Google und, über die Creative-Seite, Adobe. Daneben steht mit Black Forest Labs ein europäischer Anbieter, der als einziger ernsthaft beide Wege bedient: Schnittstelle für die, die keine Server wollen, offene Gewichte für die, die ihre Daten im Haus behalten müssen. Und darunter die Spezialisten, die eine Disziplin besser können als alle anderen und deshalb ihre Berechtigung behalten.

Wenn du aus dieser Übersicht der KI-Bildgeneratoren genau eine Sache mitnimmst, dann diese: Der Anbieter ist die kleinere Entscheidung. Die größere ist, durch welche Tür du ihn betrittst und ob du hinterher noch erklären kannst, wie ein Bild entstanden ist. Modelle wechseln im Halbjahrestakt — die Freigabeprozesse, die Ablage und die Nachweiskette, die du jetzt baust, halten deutlich länger. Bau sie so, dass ein Modellwechsel eine Konfigurationsänderung ist und kein Projekt.

Und der ehrliche Schlusssatz: Kein Anbieter in dieser Liste nimmt dir die Verantwortung ab. Die Freistellung von Adobe deckt Ansprüche wegen Trainingsdaten, nicht deine Entscheidung, ein realistisch wirkendes Personenfoto ohne Kennzeichnung in eine Pressemitteilung zu setzen. Die EU-Region bei Google schützt dich vor Datenschutzfragen, nicht vor einem Bild, das fachlich falsch ist. Werkzeuge lösen Werkzeugprobleme. Den Rest löst ihr.

Häufige Fragen

Welcher KI-Bildgenerator ist 2026 der beste?

Keiner, und das ist keine Ausweichantwort. Für Ästhetik und schnelle Entwürfe liegt Midjourney vorn, für Text im Bild Gemini 3 Pro Image, für Rechtssicherheit Adobe Firefly, für Preis und europäische Vertragsfähigkeit FLUX.2. Wenn dir jemand einen Sieger nennt, hat er entweder deinen Anwendungsfall nicht verstanden oder eine Provisionsvereinbarung.

Darf ich KI-generierte Bilder in der EU überhaupt kommerziell einsetzen?

Ja. Alle hier besprochenen Anbieter räumen zahlenden Kunden die kommerzielle Nutzung ein und erheben keinen eigenen Anspruch auf die Ergebnisse. Zwei Einschränkungen: Du erwirbst kein Urheberrecht an einem rein maschinell erzeugten Bild, kannst anderen die Verwendung eines ähnlichen Motivs also nicht verbieten. Und seit dem 2. August 2026 musst du Inhalte kennzeichnen, die als echte Aufnahme durchgehen könnten.

Ist Midjourney DSGVO-konform nutzbar?

Für den Normalkunden: nein. Es gibt keinen angebotenen Auftragsverarbeitungsvertrag, die Verarbeitung läuft in den USA, und ohne Stealth Mode sind Ergebnisse öffentlich sichtbar. Für Motive ohne Personenbezug und ohne Geschäftsgeheimnisse ist das beherrschbar. Für alles andere nimm einen Dienst mit Vertrag.

Gibt es inzwischen eine offizielle Midjourney-Schnittstelle?

Keine breit verfügbare. Es gab Umfragen und Ankündigungen in Richtung eines Unternehmenszugangs, aber nichts, worauf man eine Produktionsstrecke stellen sollte. Alle am Markt angebotenen „Midjourney-APIs“ automatisieren die Oberfläche oder den Bot — was die Nutzungsbedingungen untersagen.

Was ist mit DALL·E passiert?

Abgeschaltet. DALL·E 2 und DALL·E 3 wurden am 12. Mai 2026 aus der OpenAI-Schnittstelle entfernt, auf der Microsoft-Plattform wurde dall-e-3 am 4. März 2026 zurückgezogen. Nachfolger ist die GPT-Image-Reihe, aktuell GPT Image 2. Auch GPT Image 1 hat mit dem 23. Oktober 2026 bereits ein Abkündigungsdatum — prüf deine Skripte.

Kann ich in Cloud-Diensten einen Seed setzen und Ergebnisse reproduzieren?

Eingeschränkt. Manche Schnittstellen nehmen einen Seed entgegen, garantieren aber keine Reproduzierbarkeit über Modellstände hinweg — und der Modellstand ändert sich, ohne dass du gefragt wirst. Verlässliche Reproduzierbarkeit bekommst du nur im Selbstbetrieb mit festgehaltenen Modellgewichten. Was der Seed technisch tut, steht in Der Seed bei der KI-Bildgenerierung; warum selbst dann die Stapelgröße dazwischenfunkt, in batch_size und Reproduzierbarkeit.

Wie viel kostet ein Bild wirklich?

Zwischen 1,4 US-Cent und 24 US-Cent Listenpreis, je nach Modell und Ausgabegröße — multipliziert mit deiner Ausschussquote. Bei drei bis zehn Versuchen pro brauchbarem Motiv landest du realistisch zwischen fünf Cent und zwei Dollar je veröffentlichtem Bild. Die Abo-Anbieter rechnen anders, deckeln dafür aber die Automatisierung.

Was muss ich wegen des EU AI Act tun?

Zwei Dinge. Erstens: sicherstellen, dass die Kennzeichnung im Bild nicht verloren geht — also Content Credentials und Wasserzeichen nicht aus Versehen beim Import wegoptimieren. Zweitens: Inhalte, die als echte Aufnahme durchgehen könnten, für das Publikum sichtbar kennzeichnen. Der Bußgeldrahmen reicht bis 15 Millionen Euro oder drei Prozent des weltweiten Jahresumsatzes. Details in EU AI Act – was seit dem 2. August 2026 gilt.

Wann lohnt sich der eigene Betrieb statt der Cloud?

Grob: ab einigen zehntausend Bildern im Monat, bei echtem Bedarf an Datenhoheit oder wenn du Modellstände über Jahre einfrieren musst. Die Selbstbetriebslizenz für FLUX.2 Dev kostet 999 US-Dollar im Monat mit 100.000 Bildern; die Klein-Modelle sind unter Apache 2.0 ganz ohne Lizenzgebühr nutzbar. Welche offenen Modelle dafür taugen, steht in Die 15 wichtigsten Modelle zur lokalen Bildgenerierung; die Grundsatzabwägung in Cloud vs. lokale KI-Bildgenerierung.

Wie halte ich meinen Bildstil über Anbieterwechsel hinweg stabil?

Nicht über den Anbieter, sondern über Referenzmaterial und eine schriftlich festgehaltene Bildsprache. Referenzbilder funktionieren inzwischen bei mehreren Diensten — Firefly Image Model 5, Leonardo mit eigenen Stilmodellen, Ideogram mit Charakterreferenz. Was das praktisch bedeutet, steht in Markenkonsistente KI-generierte Bilder. Auch die Ausgabegröße gehört zur Bildsprache; dazu Auflösung & Seitenverhältnis bei KI-Bildern.

Dieses Consulting-Dokument steht als PDF zum Download bereit: https://www.boddenberg.de/ArtikelPdf/uebersicht-der.pdf — © Ulrich B. Boddenberg · boddenberg.de

Noch Fragen? Frag Uli

Du hast eine Frage zu diesem Thema? Schreib sie einfach hier rein. Ich antworte persönlich, kurz und ohne Verkaufsgespräch.

Antwort innerhalb von 24 Stunden

Deine Mailadresse nutze ich nur, um dir zu antworten. Kein Newsletter, keine Weitergabe. Zur Datenschutzerklärung