GPT Image 2
Das leistungsstärkste Bildgenerierungsmodell von OpenAI – fotorealistische Qualität, nahezu perfekte Textdarstellung und erstklassige Prompt-Treue. Veröffentlicht am 21. April 2026. Dieselbe KI, die hinter ChatGPT Images 2.0 steckt.
Beispiele





Was ist GPT Image 2?
GPT Image 2 (offizieller API-Name: gpt-image-2) wurde von OpenAI am 21. April 2026 als ChatGPT Images 2.0 veröffentlicht – der direkte Nachfolger von GPT Image 1.5 (Dezember 2025). Es ist der größte Entwicklungssprung der GPT-Image-Familie und mit der geplanten Abschaltung von DALL-E 2 und DALL-E 3 im Mai 2026 künftig die einzige Bildgenerierungsplattform von OpenAI.
Die eigentliche Neuheit ist nicht nur die Bildqualität, sondern das Schlussfolgern. GPT Image 2 ist das erste Bildmodell von OpenAI mit nativer „Denk“-Fähigkeit: Im Thinking-Modus plant es die Komposition, sucht im Web nach realen Referenzen und prüft sein Ergebnis selbst, bevor es fertigstellt. OpenAI beschreibt es als „visuellen Denkpartner“ für professionelle Produktions-Workflows.
Was ist neu in GPT Image 2?
Im Vergleich zu GPT Image 1.5 bietet GPT Image 2:
- Natives Schlussfolgern (Thinking-Modus): Das Modell plant, bevor es zeichnet – eine Premiere für ein OpenAI-Bildmodell. Es plant das Layout, durchsucht das Web und prüft anschließend sein eigenes Ergebnis.
- Native 2K-Auflösung (2048px): Der Hochskalierungsschritt, der in früheren Workflows die Qualität verschlechterte, entfällt.
- Nahezu perfekte Textdarstellung: 19 von 20 textlastigen Prompts liefern beim ersten Versuch lesbaren Text (Praxistests von PixVerse). Jetzt auch mit Japanisch, Koreanisch, Chinesisch, Hindi und Bengalisch.
- Beliebiges Seitenverhältnis (3:1 bis 1:3): von ultrabreiten Bannern bis zu hohen Smartphone-Formaten – ohne feste Vorgaben.
- Mehrere Bilder im Batch (bis zu 8): Erstelle aus einem einzigen Prompt einen kompletten Comicstrip, ein Storyboard oder eine Kampagne mit konsistenten Figuren (Thinking-Modus).
GPT Image 2 im Vergleich zu früheren OpenAI-Modellen
DALL-E 2 und DALL-E 3 wurden am 12. Mai 2026 eingestellt. GPT Image 2 ist jetzt die einzige Bildgenerierungsplattform von OpenAI.
| Funktion | DALL-E 3 | GPT Image 1/1.5 | GPT Image 2 ✦ |
|---|---|---|---|
| Natives Schlussfolgern / Thinking | ✗ | ✗ | ✓ Erstmals |
| Maximale Auflösung | 1024px | 1536px | 2048px (2K) |
| Genauigkeit der Textdarstellung | Schwach | Mittel | Nahezu perfekt (19/20) |
| CJK / Hindi / Bengalisch | ✗ | Eingeschränkt | ✓ Zeichengenau |
| Bereich der Seitenverhältnisse | Feste Vorgaben | Feste Vorgaben | 3:1 → 1:3 (beliebig) |
| Mehrere Bilder im Batch | ✗ | ✗ | Bis zu 8 (Thinking) |
| Websuche während der Generierung | ✗ | ✗ | ✓ (Thinking-Modus) |
| Bildbearbeitung | ✗ | ✓ (1.5) | ✓ Erweitert |
| Transparenter Hintergrund | ✓ | ✓ | ✗ Nicht unterstützt |
| C2PA-Herkunftsmetadaten | ✗ | Teilweise | ✓ Bei allen Ausgaben |
Die wichtigsten Funktionen
Nativer Thinking-Modus
Das erste Bildmodell von OpenAI, das schlussfolgern kann. Es plant die Komposition, sucht im Web nach Referenzen und prüft sein Ergebnis vor dem Abschluss – das erhöht die Trefferquote beim ersten Versuch bei komplexen Prompts enorm.

Präzise Textdarstellung
19 von 20 textlastigen Generierungen liefern beim ersten Versuch lesbaren Text (PixVerse-Tests). Beherrscht mehrzeilige Überschriften, nicht-lateinische Schriften, mehrsprachige Layouts und dichte UI-Texte.

Fotorealistische Ergebnisse
Gibt Hauttextur, Materialreflexionen, Körnung, Schärfentiefe und feine Unregelmäßigkeiten im Licht wieder. Canva nannte es „kreatives Denken und Designgespür – dieser Wandel ist gerade passiert“.

2K-Auflösung und beliebiges Seitenverhältnis
Native Ausgabe in 2048px. Unterstützt jedes Seitenverhältnis von 3:1 ultrabreit (Banner) bis 1:3 ultrahoch (Smartphone-Bildschirme) – ohne den Hochskalierungsschritt, der in früheren Workflows die Qualität verschlechterte.

Batch-Generierung mehrerer Bilder
Erstelle bis zu 8 zusammenhängende Bilder aus einem einzigen Prompt, mit konsistenten Figuren im gesamten Batch (Thinking-Modus). Ein Prompt → ein kompletter Comicstrip, ein Storyboard oder eine Kampagne.

C2PA-Herkunftsnachweis und Sicherheit
Jede Ausgabe von GPT Image 2 enthält C2PA-Metadaten – einen maschinell prüfbaren Nachweis, dass das Bild KI-generiert ist. Die Inhaltsmoderation ist streng, lässt aber breiten kreativen Spielraum.

Prompt-Leitfaden für GPT Image 2
Bewährte Prompts nach Kategorien sortiert. Kopiere einen Prompt und füge ihn links in den Generator ein.
Filmisches Porträt
Textlastige Plakate und Designs
Figuren- und UI-Design
Infografik und Experimentelles
Die Prompt-Formel
Schreib wie ein Regisseur, der einen Fotografen brieft. Bring die wichtigsten Details in den ersten 50 Wörtern unter.
[Stil/Medium] + [Motiv] + [Umgebung] + [Licht] + [Komposition] + [Technische Angaben]
Wer GPT Image 2 nutzt – und warum
E-Commerce- und Produktteams
Erstelle Hero-Bilder, Lifestyle-Aufnahmen und Produktfotos vor Hintergrund ganz ohne Studio. Dank des Fotorealismus von GPT Image 2 können die Ergebnisse direkt in Shopify-Listings oder Amazon-Produktseiten einfließen.
Social-Media-Manager
Erstelle einzigartige, markenkonforme Visuals in großer Menge. Dank präziser Textdarstellung lassen sich Post-Grafiken samt eingeblendetem Text generieren – woran die meisten KI-Modelle scheitern.
Autorinnen und Autoren
Erstelle Titelillustrationen, Referenzbilder für Figuren, Szenenvisualisierungen und Buchcover. Die Porträtqualität kann es in vielen Fällen mit Auftragsillustrationen aufnehmen.
Architekten und Designer
Visualisiere Innenraumkonzepte, Materialkombinationen und Raumaufteilungen, bevor du in die Umsetzung gehst. Schnelle Ideenfindung zu einem Bruchteil der Kosten von 3D-Renderings.
Lehrkräfte und Forschende
Erstelle illustrierte Diagramme, Rekonstruktionen historischer Szenen und visuelle Lernmaterialien. Forschungslabore nutzen GPT Image 2, um KI-generierte Inhalte in großem Maßstab zu untersuchen.
Marketing- und Markenteams
Schnelle Konzeptvisualisierung für Kampagnen. Erstelle in Minuten mehrere kreative Richtungen, präsentiere sie den Entscheidern und investiere nur in die stärksten Ideen.
GPT Image 2 in der wissenschaftlichen Forschung
Arxiv · 2604.25213 · April 2026
When the Forger Is the Judge: GPT-Image-2 Cannot Recognize Its Own Faked Documents
Diese Studie zeigt, dass GPT Image 2 fotorealistische Dokumente erzeugen kann – so realistisch, dass das Modell sie selbst nicht als KI-generiert erkennt. Die Arbeit unterstreicht den beispiellosen Fotorealismus des Modells und wirft wichtige Fragen zur Echtheitsprüfung von Dokumenten auf.
Arxiv · 2604.25370 · April 2026
GPT-Image-2 in the Wild: A Twitter Dataset of Self-Reported AI-Generated Images from the First Week of Deployment
Forschende sammelten und analysierten Tausende Bilder, die in der ersten Woche nach dem Start von GPT Image 2 öffentlich auf Twitter geteilt wurden. Der Datensatz dokumentiert reale Nutzungsmuster, beliebte kreative Kategorien und die Verbreitung KI-generierter Inhalte auf sozialen Plattformen.
Häufig gestellte Fragen
GPT Image 2 (offizieller API-Name: gpt-image-2, auch als ChatGPT Images 2.0 vermarktet) ist das fortschrittlichste Bildgenerierungsmodell von OpenAI und wurde am 21. April 2026 veröffentlicht. Es ist der direkte Nachfolger von GPT Image 1.5 (Dezember 2025) und seit der Abschaltung von DALL-E 2 und DALL-E 3 im Mai 2026 die einzige Bildgenerierungsplattform von OpenAI. Es ist das erste OpenAI-Bildmodell mit nativer „Denk“-Fähigkeit – es plant, durchsucht das Web und prüft sich selbst, bevor es ein Bild fertigstellt.
GPT Image 2 bietet zwei Modi. Der Instant-Modus steht allen Nutzern offen, auch in der kostenlosen Version, und bringt die zentralen Qualitätsverbesserungen: 2K-Auflösung, präzise Textdarstellung und Fotorealismus. Der Thinking-Modus (für Abonnenten von ChatGPT Plus, Pro, Business und Enterprise) schaltet die Reasoning-Ebene frei: Das Modell plant die Komposition, sucht im Web nach realen visuellen Referenzen, erzeugt bis zu 8 zusammenhängende Bilder in einem Batch mit konsistenten Figuren und prüft das Ergebnis vor dem Abschluss. Für die meisten Einzelbilder reicht der Instant-Modus aus.
Nein – und DALL-E 3 wurde inzwischen sogar eingestellt (12. Mai 2026). GPT Image 2 ist eine völlig neue Architektur von OpenAI, kein Update von DALL-E. Die wichtigsten Unterschiede: GPT Image 2 liefert bis zu 2K (2048px) statt 1024px bei DALL-E 3; es stellt Text nahezu perfekt dar, wo DALL-E 3 unzuverlässig war; es unterstützt jedes Seitenverhältnis von 3:1 bis 1:3; und es ist das erste Bildmodell mit nativem Schlussfolgern.
Nein – gpt-image-2 unterstützt keine transparenten Hintergründe (PNG mit Alphakanal). Wenn du freigestellte Elemente ohne Hintergrund brauchst, verwende GPT Image 1 oder 1.5 oder bearbeite das Ergebnis in Photoshop/Figma nach. Für Produktfotos mit weißem Hintergrund schreibst du stattdessen "on a pure white background, studio lighting" in den Prompt.
Jede Generierung mit GPT Image 2 kostet 5 Credits. Der höhere Preis spiegelt den Rechenaufwand von GPT Image 2 gegenüber einfacheren Modellen wider – die Inferenz ist deutlich komplexer, besonders bei hoher Qualität. Credits kannst du über unsere Preisseite aufladen.
Deutlich besser als bei jedem früheren Bildmodell von OpenAI. In den Praxistests von PixVerse mit 14 Plakat- und Typografie-Prompts lieferten 19 von 20 textlastigen Generierungen beim ersten Versuch lesbaren, korrekt geschriebenen Text. Lateinische Schriften gibt das Modell in 2K nahezu perfekt wieder, und auch bei nicht-lateinischen Schriften wie Japanisch, Koreanisch, Chinesisch, Hindi und Bengalisch erreicht es Zeichengenauigkeit.
Markenlogos werden nicht zuverlässig wiedergegeben. Die Generierung ist langsamer als bei leichten Modellen wie FLUX Schnell. Keine transparenten Hintergründe. Die Inhaltsrichtlinien sind strenger als bei Open-Source-Alternativen. Komplexe Aufgaben aus der physischen Welt (Origami-Schritte, Rubik’s-Cube-Diagramme, gespiegelte oder schräge Oberflächen) können weiterhin misslingen. Sehr dichte oder sich wiederholende feine Details können an Kohärenz verlieren.
Schreib wie ein Regisseur, der einen Fotografen brieft. Nutze die Formel: [Stil/Medium] + [Motiv] + [Umgebung] + [Licht] + [Komposition] + [Technische Angaben]. Bring die wichtigsten Details in den ersten 50 Wörtern unter. Gib das Seitenverhältnis ausdrücklich an ("aspect ratio 9:16"). Für exakten Text fügst du am Ende "All text must be fully accurate" hinzu.
Auch bekannt als