Eingabebilder optional
Prompt erforderlich
Einstellungen

GPT Image 2

Das leistungsstärkste Bildgenerierungsmodell von OpenAI – fotorealistische Qualität, nahezu perfekte Textdarstellung und erstklassige Prompt-Treue. Veröffentlicht am 21. April 2026. Dieselbe KI, die hinter ChatGPT Images 2.0 steckt.

Beispiele

Schmuck, erstellt mit GPT Image 2Porträt, generiert mit GPT Image 2Filmische halbtotale Aufnahme auf Augenhöhe, erstellt mit GPT Image 2Kreatives Werbeplakat, erstellt mit GPT Image 2Collage-Anzeige für Luxusmode, erstellt mit GPT Image 2
2K-AuflösungTextdarstellungFotorealistischBeliebiges SeitenverhältnisThinking-Modus

Was ist GPT Image 2?

GPT Image 2 (offizieller API-Name: gpt-image-2) wurde von OpenAI am 21. April 2026 als ChatGPT Images 2.0 veröffentlicht – der direkte Nachfolger von GPT Image 1.5 (Dezember 2025). Es ist der größte Entwicklungssprung der GPT-Image-Familie und mit der geplanten Abschaltung von DALL-E 2 und DALL-E 3 im Mai 2026 künftig die einzige Bildgenerierungsplattform von OpenAI.

Die eigentliche Neuheit ist nicht nur die Bildqualität, sondern das Schlussfolgern. GPT Image 2 ist das erste Bildmodell von OpenAI mit nativer „Denk“-Fähigkeit: Im Thinking-Modus plant es die Komposition, sucht im Web nach realen Referenzen und prüft sein Ergebnis selbst, bevor es fertigstellt. OpenAI beschreibt es als „visuellen Denkpartner“ für professionelle Produktions-Workflows.

2K
Native Auflösung
Ausgabe in 2048px
19/20
Textgenauigkeit
Lesbar beim ersten Versuch (PixVerse-Tests)
3:1→1:3
Seitenverhältnisse
Jedes Format unterstützt
8×
Batch-Generierung
Konsistente Figuren (Thinking-Modus)

Was ist neu in GPT Image 2?

Im Vergleich zu GPT Image 1.5 bietet GPT Image 2:

  • Natives Schlussfolgern (Thinking-Modus): Das Modell plant, bevor es zeichnet – eine Premiere für ein OpenAI-Bildmodell. Es plant das Layout, durchsucht das Web und prüft anschließend sein eigenes Ergebnis.
  • Native 2K-Auflösung (2048px): Der Hochskalierungsschritt, der in früheren Workflows die Qualität verschlechterte, entfällt.
  • Nahezu perfekte Textdarstellung: 19 von 20 textlastigen Prompts liefern beim ersten Versuch lesbaren Text (Praxistests von PixVerse). Jetzt auch mit Japanisch, Koreanisch, Chinesisch, Hindi und Bengalisch.
  • Beliebiges Seitenverhältnis (3:1 bis 1:3): von ultrabreiten Bannern bis zu hohen Smartphone-Formaten – ohne feste Vorgaben.
  • Mehrere Bilder im Batch (bis zu 8): Erstelle aus einem einzigen Prompt einen kompletten Comicstrip, ein Storyboard oder eine Kampagne mit konsistenten Figuren (Thinking-Modus).

GPT Image 2 im Vergleich zu früheren OpenAI-Modellen

DALL-E 2 und DALL-E 3 wurden am 12. Mai 2026 eingestellt. GPT Image 2 ist jetzt die einzige Bildgenerierungsplattform von OpenAI.

FunktionDALL-E 3GPT Image 1/1.5GPT Image 2 ✦
Natives Schlussfolgern / Thinking✗✗✓ Erstmals
Maximale Auflösung1024px1536px2048px (2K)
Genauigkeit der TextdarstellungSchwachMittelNahezu perfekt (19/20)
CJK / Hindi / Bengalisch✗Eingeschränkt✓ Zeichengenau
Bereich der SeitenverhältnisseFeste VorgabenFeste Vorgaben3:1 → 1:3 (beliebig)
Mehrere Bilder im Batch✗✗Bis zu 8 (Thinking)
Websuche während der Generierung✗✗✓ (Thinking-Modus)
Bildbearbeitung✗✓ (1.5)✓ Erweitert
Transparenter Hintergrund✓✓✗ Nicht unterstützt
C2PA-Herkunftsmetadaten✗Teilweise✓ Bei allen Ausgaben

Die wichtigsten Funktionen

Nativer Thinking-Modus

Das erste Bildmodell von OpenAI, das schlussfolgern kann. Es plant die Komposition, sucht im Web nach Referenzen und prüft sein Ergebnis vor dem Abschluss – das erhöht die Trefferquote beim ersten Versuch bei komplexen Prompts enorm.

Erklärung einer Matheaufgabe, erstellt mit GPT Image 2

Präzise Textdarstellung

19 von 20 textlastigen Generierungen liefern beim ersten Versuch lesbaren Text (PixVerse-Tests). Beherrscht mehrzeilige Überschriften, nicht-lateinische Schriften, mehrsprachige Layouts und dichte UI-Texte.

Makellose Typografie in mehreren Sprachen, erstellt mit GPT Image 2

Fotorealistische Ergebnisse

Gibt Hauttextur, Materialreflexionen, Körnung, Schärfentiefe und feine Unregelmäßigkeiten im Licht wieder. Canva nannte es „kreatives Denken und Designgespür – dieser Wandel ist gerade passiert“.

Hyperrealistisches Spiegel-Selfie einer schönen jungen Frau in einem luxuriösen beigen Marmorbad bei Nacht, erstellt mit GPT Image 2

2K-Auflösung und beliebiges Seitenverhältnis

Native Ausgabe in 2048px. Unterstützt jedes Seitenverhältnis von 3:1 ultrabreit (Banner) bis 1:3 ultrahoch (Smartphone-Bildschirme) – ohne den Hochskalierungsschritt, der in früheren Workflows die Qualität verschlechterte.

Detailreiches Unboxing-Plakat für ein Luxusprodukt, erstellt mit GPT Image 2

Batch-Generierung mehrerer Bilder

Erstelle bis zu 8 zusammenhängende Bilder aus einem einzigen Prompt, mit konsistenten Figuren im gesamten Batch (Thinking-Modus). Ein Prompt → ein kompletter Comicstrip, ein Storyboard oder eine Kampagne.

Fiktives erwachsenes koreanisches Idol Mitte 20, erstellt mit GPT Image 2

C2PA-Herkunftsnachweis und Sicherheit

Jede Ausgabe von GPT Image 2 enthält C2PA-Metadaten – einen maschinell prüfbaren Nachweis, dass das Bild KI-generiert ist. Die Inhaltsmoderation ist streng, lässt aber breiten kreativen Spielraum.

GPT-Image-Sicherheit laut System Card von ChatGPT Image 2

Prompt-Leitfaden für GPT Image 2

Bewährte Prompts nach Kategorien sortiert. Kopiere einen Prompt und füge ihn links in den Generator ein.

Filmisches Porträt

“A photorealistic candid travel scene of a person standing at a coastal roadside turnout on an overcast morning, shot on 35mm film. Natural imperfect framing, visible grain, ambient light, muted colors, wind in clothing and hair, cinematic realism.”
“35mm film photography, warm natural window light. A young woman sitting in a vintage bookshop, reading a hardcover book. Soft afternoon sunlight filtering through dusty windows. Medium shot, slightly off-center composition. Aspect ratio 3:4.”
“A photorealistic snapshot portrait of two friends outside a venue at night, shot on a compact point-and-shoot camera with direct flash. Crisp foreground detail, deep shadow falloff, spontaneous energy, early-2000s flash photograph aesthetic.”

Textlastige Plakate und Designs

“A striking Spring 2026 city poster for New York with a bold contemporary design. Typography reads "SPRING 2026" with slogan "NEW YORK — A CITY OF BRIDGES, DREAMS, AND REINVENTION". Text must be sharp and beautifully composed. Aspect ratio 9:16.”
“"japanese-manga-style disassembly" of a basketball dunk shoot motion like a time lapse. Tell the most story through visuals rather than text. 3:1 ultrawide aspect ratio. Prefer light background rather than dark.”
“A premium Japanese restaurant menu printed on dark washi paper. The restaurant name "黒松" (Kuromatsu) in large calligraphic brushstroke lettering. Omakase Course with five dishes, Japanese names on the left and English on the right. All text must be fully accurate.”

Figuren- und UI-Design

“Professional character reference sheet for a young female mage with silver hair and violet eyes, ornate dark cloak with glowing rune patterns. Three-view turnaround, facial expression variations, costume breakdown, color palette swatch row. Aspect ratio 16:9.”
“A hyper-realistic iPhone screenshot of a fictional Instagram profile for Leonardo da Vinci, username @davinci_official, as a modern influencer. 9 posts showing Mona Lisa as a mirror selfie, helicopter sketch as a drone design drop, anatomy studies as gym progress. Dark mode. Aspect ratio 9:16.”
“Make an advertisement for a matcha shop called "kizuki" opening in Brooklyn Heights. Sunlit strawberry matcha (iced), streetwear aesthetic with Japanese minimalism. Square format for Instagram feed.”

Infografik und Experimentelles

“Cantor's diagonalization proof, rendered as a clean educational infographic. Clearly labeled diagram showing the diagonal argument, precise mathematical notation, and brief explanatory annotations. Light background, structured layout. Aspect ratio 4:3.”
“Inside a museum exhibit titled "Ancient Technology: The Desktop Era", a programmer in a glass display case is live-demonstrating coding on a CRT monitor while amazed schoolchildren press their faces against the glass. 2D cartoon illustration style, warm museum lighting. Aspect ratio 16:9.”
“A sample page of a colorized Japanese shonen adventure manga. The main character finds a magical quill with an OpenAI logo. Make it dramatic. All dialogue and text in Japanese. The page should appear as a photo of a physical page. Aspect ratio 9:16.”

Die Prompt-Formel

Schreib wie ein Regisseur, der einen Fotografen brieft. Bring die wichtigsten Details in den ersten 50 Wörtern unter.

[Stil/Medium] + [Motiv] + [Umgebung] + [Licht] + [Komposition] + [Technische Angaben]

Wer GPT Image 2 nutzt – und warum

E-Commerce- und Produktteams

Erstelle Hero-Bilder, Lifestyle-Aufnahmen und Produktfotos vor Hintergrund ganz ohne Studio. Dank des Fotorealismus von GPT Image 2 können die Ergebnisse direkt in Shopify-Listings oder Amazon-Produktseiten einfließen.

Social-Media-Manager

Erstelle einzigartige, markenkonforme Visuals in großer Menge. Dank präziser Textdarstellung lassen sich Post-Grafiken samt eingeblendetem Text generieren – woran die meisten KI-Modelle scheitern.

Autorinnen und Autoren

Erstelle Titelillustrationen, Referenzbilder für Figuren, Szenenvisualisierungen und Buchcover. Die Porträtqualität kann es in vielen Fällen mit Auftragsillustrationen aufnehmen.

Architekten und Designer

Visualisiere Innenraumkonzepte, Materialkombinationen und Raumaufteilungen, bevor du in die Umsetzung gehst. Schnelle Ideenfindung zu einem Bruchteil der Kosten von 3D-Renderings.

Lehrkräfte und Forschende

Erstelle illustrierte Diagramme, Rekonstruktionen historischer Szenen und visuelle Lernmaterialien. Forschungslabore nutzen GPT Image 2, um KI-generierte Inhalte in großem Maßstab zu untersuchen.

Marketing- und Markenteams

Schnelle Konzeptvisualisierung für Kampagnen. Erstelle in Minuten mehrere kreative Richtungen, präsentiere sie den Entscheidern und investiere nur in die stärksten Ideen.

GPT Image 2 in der wissenschaftlichen Forschung

Häufig gestellte Fragen

GPT Image 2 (offizieller API-Name: gpt-image-2, auch als ChatGPT Images 2.0 vermarktet) ist das fortschrittlichste Bildgenerierungsmodell von OpenAI und wurde am 21. April 2026 veröffentlicht. Es ist der direkte Nachfolger von GPT Image 1.5 (Dezember 2025) und seit der Abschaltung von DALL-E 2 und DALL-E 3 im Mai 2026 die einzige Bildgenerierungsplattform von OpenAI. Es ist das erste OpenAI-Bildmodell mit nativer „Denk“-Fähigkeit – es plant, durchsucht das Web und prüft sich selbst, bevor es ein Bild fertigstellt.

GPT Image 2 bietet zwei Modi. Der Instant-Modus steht allen Nutzern offen, auch in der kostenlosen Version, und bringt die zentralen Qualitätsverbesserungen: 2K-Auflösung, präzise Textdarstellung und Fotorealismus. Der Thinking-Modus (für Abonnenten von ChatGPT Plus, Pro, Business und Enterprise) schaltet die Reasoning-Ebene frei: Das Modell plant die Komposition, sucht im Web nach realen visuellen Referenzen, erzeugt bis zu 8 zusammenhängende Bilder in einem Batch mit konsistenten Figuren und prüft das Ergebnis vor dem Abschluss. Für die meisten Einzelbilder reicht der Instant-Modus aus.

Nein – und DALL-E 3 wurde inzwischen sogar eingestellt (12. Mai 2026). GPT Image 2 ist eine völlig neue Architektur von OpenAI, kein Update von DALL-E. Die wichtigsten Unterschiede: GPT Image 2 liefert bis zu 2K (2048px) statt 1024px bei DALL-E 3; es stellt Text nahezu perfekt dar, wo DALL-E 3 unzuverlässig war; es unterstützt jedes Seitenverhältnis von 3:1 bis 1:3; und es ist das erste Bildmodell mit nativem Schlussfolgern.

Nein – gpt-image-2 unterstützt keine transparenten Hintergründe (PNG mit Alphakanal). Wenn du freigestellte Elemente ohne Hintergrund brauchst, verwende GPT Image 1 oder 1.5 oder bearbeite das Ergebnis in Photoshop/Figma nach. Für Produktfotos mit weißem Hintergrund schreibst du stattdessen "on a pure white background, studio lighting" in den Prompt.

Jede Generierung mit GPT Image 2 kostet 5 Credits. Der höhere Preis spiegelt den Rechenaufwand von GPT Image 2 gegenüber einfacheren Modellen wider – die Inferenz ist deutlich komplexer, besonders bei hoher Qualität. Credits kannst du über unsere Preisseite aufladen.

Deutlich besser als bei jedem früheren Bildmodell von OpenAI. In den Praxistests von PixVerse mit 14 Plakat- und Typografie-Prompts lieferten 19 von 20 textlastigen Generierungen beim ersten Versuch lesbaren, korrekt geschriebenen Text. Lateinische Schriften gibt das Modell in 2K nahezu perfekt wieder, und auch bei nicht-lateinischen Schriften wie Japanisch, Koreanisch, Chinesisch, Hindi und Bengalisch erreicht es Zeichengenauigkeit.

Markenlogos werden nicht zuverlässig wiedergegeben. Die Generierung ist langsamer als bei leichten Modellen wie FLUX Schnell. Keine transparenten Hintergründe. Die Inhaltsrichtlinien sind strenger als bei Open-Source-Alternativen. Komplexe Aufgaben aus der physischen Welt (Origami-Schritte, Rubik’s-Cube-Diagramme, gespiegelte oder schräge Oberflächen) können weiterhin misslingen. Sehr dichte oder sich wiederholende feine Details können an Kohärenz verlieren.

Schreib wie ein Regisseur, der einen Fotografen brieft. Nutze die Formel: [Stil/Medium] + [Motiv] + [Umgebung] + [Licht] + [Komposition] + [Technische Angaben]. Bring die wichtigsten Details in den ersten 50 Wörtern unter. Gib das Seitenverhältnis ausdrücklich an ("aspect ratio 9:16"). Für exakten Text fügst du am Ende "All text must be fully accurate" hinzu.

Auch bekannt als

gpt image 2gpt image 2 kostenloschatgpt bildchatgpt bilder erstellenchatgpt bildgeneratorchat gpt bild generierenchatgpt bilder generieren kostenloski bilder erstellen chatgptopenai bildgeneratorgpt image online