images source facultatif
prompt obligatoire
paramètres

GPT Image 2

Le modèle de génération d’images le plus performant d’OpenAI : qualité photoréaliste, rendu du texte quasi parfait et respect exemplaire des consignes. Sorti le 21 avril 2026. La même IA que celle de ChatGPT Images 2.0.

exemples

Bijoux créés avec GPT Image 2Portrait généré avec GPT Image 2Plan moyen large cinématographique à hauteur des yeux créé avec GPT Image 2Affiche publicitaire commerciale créative créée avec GPT Image 2Publicité en collage de mode de luxe créée avec GPT Image 2
Résolution 2KRendu du textePhotoréalisteTous les formatsMode Thinking

Qu’est-ce que GPT Image 2 ?

GPT Image 2 (nom officiel dans l’API : gpt-image-2) a été lancé par OpenAI le 21 avril 2026 sous le nom ChatGPT Images 2.0, successeur direct de GPT Image 1.5 (décembre 2025). C’est l’avancée la plus importante de la famille GPT Image et, avec le retrait programmé de DALL-E 2 et DALL-E 3 en mai 2026, désormais l’unique plateforme de génération d’images d’OpenAI.

La grande nouveauté ne tient pas qu’à la qualité d’image : c’est le raisonnement. GPT Image 2 est le premier modèle d’image d’OpenAI doté d’une capacité native de « réflexion » : en mode Thinking, il planifie la composition, cherche des références réelles sur le web et vérifie lui-même son résultat avant de le finaliser. OpenAI le décrit comme un « partenaire de réflexion visuelle » conçu pour les workflows de production.

2K
Résolution native
Sortie en 2048px
19/20
Précision du texte
Lisible dès le premier essai (tests PixVerse)
3:1→1:3
Formats
Tous les formats pris en charge
8×
Génération par lots
Personnages cohérents (mode Thinking)

Quoi de neuf dans GPT Image 2 ?

Par rapport à GPT Image 1.5, GPT Image 2 apporte :

  • Raisonnement natif (mode Thinking) : le modèle planifie avant de dessiner, une première pour un modèle d’image d’OpenAI. Il organise la mise en page, cherche sur le web, puis vérifie son propre résultat.
  • Résolution native 2K (2048px) : supprime l’étape d’agrandissement qui dégradait la qualité dans les workflows précédents.
  • Rendu du texte quasi parfait : 19 prompts riches en texte sur 20 donnent un texte lisible dès le premier essai (tests pratiques de PixVerse). Gère désormais le japonais, le coréen, le chinois, l’hindi et le bengali.
  • Tous les formats (de 3:1 à 1:3) : des bannières ultra-larges aux écrans mobiles tout en hauteur, sans formats prédéfinis.
  • Lots de plusieurs images (jusqu’à 8) : générez une BD complète, un storyboard ou une campagne avec des personnages cohérents à partir d’un seul prompt (mode Thinking).

GPT Image 2 face aux anciens modèles d’OpenAI

DALL-E 2 et DALL-E 3 ont été retirés le 12 mai 2026. GPT Image 2 est désormais l’unique plateforme de génération d’images d’OpenAI.

FonctionnalitéDALL-E 3GPT Image 1/1.5GPT Image 2 ✦
Raisonnement natif / Thinking✗✗✓ Une première
Résolution max.1024px1536px2048px (2K)
Précision du rendu du texteFaibleMoyenneQuasi parfaite (19/20)
Texte CJK / hindi / bengali✗Limité✓ Précis au caractère près
Plage de formatsFormats fixesFormats fixes3:1 → 1:3 (au choix)
Lots de plusieurs images✗✗Jusqu’à 8 (Thinking)
Recherche web pendant la génération✗✗✓ (mode Thinking)
Retouche d’images✗✓ (1.5)✓ Avancée
Fond transparent✓✓✗ Non pris en charge
Métadonnées de provenance C2PA✗Partielles✓ Sur toutes les images

Fonctionnalités clés

Mode Thinking natif

Le premier modèle d’image d’OpenAI capable de raisonner. Il planifie la composition, cherche des références sur le web et vérifie son résultat avant de finir, ce qui augmente fortement le taux de réussite du premier coup sur les prompts complexes.

Explication d’un problème de maths créée avec GPT Image 2

Rendu du texte précis

19 générations riches en texte sur 20 sont lisibles dès le premier essai (tests PixVerse). Gère les titres sur plusieurs lignes, les écritures non latines, les mises en page multilingues et les textes d’interface denses.

Typographie impeccable en plusieurs langues créée avec GPT Image 2

Rendu photoréaliste

Restitue la texture de la peau, les reflets des matières, le grain, la profondeur de champ et les subtiles imperfections de la lumière. Canva y voit « du raisonnement créatif et du goût en design : ce tournant vient d’avoir lieu ».

Selfie hyperréaliste dans un miroir d’une belle jeune femme dans une luxueuse salle de bain en marbre beige, de nuit, créé avec GPT Image 2

Résolution 2K et tous les formats

Sortie native en 2048px. Prend en charge tous les formats, du 3:1 ultra-large (bannières) au 1:3 ultra-haut (écrans mobiles), sans l’étape d’agrandissement qui dégradait la qualité dans les workflows précédents.

Affiche d’unboxing de luxe très détaillée créée avec GPT Image 2

Génération de plusieurs images par lot

Générez jusqu’à 8 images cohérentes à partir d’un seul prompt, avec des personnages constants sur tout le lot (mode Thinking). Un prompt → une BD, un storyboard ou une campagne complets.

Idole coréenne fictive d’environ 25 ans créée avec GPT Image 2

Provenance C2PA et sécurité

Chaque image GPT Image 2 intègre des métadonnées C2PA, une preuve vérifiable par machine que l’image a été générée par IA. La modération est stricte mais laisse une large place à la création.

Sécurité de GPT Image d’après la System Card de ChatGPT Image 2

Guide des prompts GPT Image 2

Des prompts performants classés par catégorie. Copiez-en un et collez-le dans le générateur à gauche.

Portrait cinématographique

“A photorealistic candid travel scene of a person standing at a coastal roadside turnout on an overcast morning, shot on 35mm film. Natural imperfect framing, visible grain, ambient light, muted colors, wind in clothing and hair, cinematic realism.”
“35mm film photography, warm natural window light. A young woman sitting in a vintage bookshop, reading a hardcover book. Soft afternoon sunlight filtering through dusty windows. Medium shot, slightly off-center composition. Aspect ratio 3:4.”
“A photorealistic snapshot portrait of two friends outside a venue at night, shot on a compact point-and-shoot camera with direct flash. Crisp foreground detail, deep shadow falloff, spontaneous energy, early-2000s flash photograph aesthetic.”

Affiche et design riches en texte

“A striking Spring 2026 city poster for New York with a bold contemporary design. Typography reads "SPRING 2026" with slogan "NEW YORK — A CITY OF BRIDGES, DREAMS, AND REINVENTION". Text must be sharp and beautifully composed. Aspect ratio 9:16.”
“"japanese-manga-style disassembly" of a basketball dunk shoot motion like a time lapse. Tell the most story through visuals rather than text. 3:1 ultrawide aspect ratio. Prefer light background rather than dark.”
“A premium Japanese restaurant menu printed on dark washi paper. The restaurant name "黒松" (Kuromatsu) in large calligraphic brushstroke lettering. Omakase Course with five dishes, Japanese names on the left and English on the right. All text must be fully accurate.”

Personnages et design d’interface

“Professional character reference sheet for a young female mage with silver hair and violet eyes, ornate dark cloak with glowing rune patterns. Three-view turnaround, facial expression variations, costume breakdown, color palette swatch row. Aspect ratio 16:9.”
“A hyper-realistic iPhone screenshot of a fictional Instagram profile for Leonardo da Vinci, username @davinci_official, as a modern influencer. 9 posts showing Mona Lisa as a mirror selfie, helicopter sketch as a drone design drop, anatomy studies as gym progress. Dark mode. Aspect ratio 9:16.”
“Make an advertisement for a matcha shop called "kizuki" opening in Brooklyn Heights. Sunlit strawberry matcha (iced), streetwear aesthetic with Japanese minimalism. Square format for Instagram feed.”

Infographie et expérimental

“Cantor's diagonalization proof, rendered as a clean educational infographic. Clearly labeled diagram showing the diagonal argument, precise mathematical notation, and brief explanatory annotations. Light background, structured layout. Aspect ratio 4:3.”
“Inside a museum exhibit titled "Ancient Technology: The Desktop Era", a programmer in a glass display case is live-demonstrating coding on a CRT monitor while amazed schoolchildren press their faces against the glass. 2D cartoon illustration style, warm museum lighting. Aspect ratio 16:9.”
“A sample page of a colorized Japanese shonen adventure manga. The main character finds a magical quill with an OpenAI logo. Make it dramatic. All dialogue and text in Japanese. The page should appear as a photo of a physical page. Aspect ratio 9:16.”

La formule du prompt

Écrivez comme un réalisateur qui briefe un photographe. Placez les détails essentiels dans les 50 premiers mots.

[Style/Technique] + [Sujet] + [Décor] + [Éclairage] + [Composition] + [Caractéristiques techniques]

Qui utilise GPT Image 2, et pourquoi

E-commerce et équipes produit

Générez des visuels principaux, des photos lifestyle et des packshots sur fond sans passer par un studio. Grâce au photoréalisme de GPT Image 2, les images peuvent aller directement dans vos fiches Shopify ou vos pages produit Amazon.

Community managers

Créez des visuels uniques et fidèles à votre marque, à grande échelle. Le texte étant précis, vous pouvez générer des visuels de posts avec le texte incrusté, là où la plupart des modèles d’IA échouent.

Écrivains et auteurs

Générez des illustrations de couverture, des références de personnages, des visualisations de scènes et des couvertures de livres. Dans bien des cas, la qualité des portraits rivalise avec une illustration de commande.

Architectes et designers

Visualisez concepts d’intérieur, associations de matériaux et agencements avant de passer en production. Une idéation rapide pour une fraction du coût d’un rendu 3D.

Enseignants et chercheurs

Créez des schémas illustrés, des reconstitutions de scènes historiques et des supports pédagogiques visuels. Des laboratoires de recherche utilisent GPT Image 2 pour étudier à grande échelle les contenus générés par IA.

Équipes marketing et marque

Visualisez rapidement vos concepts de campagne. Générez plusieurs pistes créatives en quelques minutes, présentez-les aux décideurs et n’investissez que dans les meilleures idées.

GPT Image 2 dans la recherche académique

Questions fréquentes

GPT Image 2 (nom officiel dans l’API : gpt-image-2, aussi commercialisé sous le nom ChatGPT Images 2.0) est le modèle de génération d’images le plus avancé d’OpenAI, sorti le 21 avril 2026. C’est le successeur direct de GPT Image 1.5 (décembre 2025) et, depuis le retrait de DALL-E 2 et DALL-E 3 en mai 2026, l’unique plateforme de génération d’images d’OpenAI. C’est aussi le premier modèle d’image d’OpenAI doté d’une capacité native de « réflexion » : il planifie, cherche sur le web et se vérifie avant de finaliser une image.

GPT Image 2 propose deux modes. Le mode Instant, accessible à tous les utilisateurs, y compris en version gratuite, apporte les principales améliorations de qualité : résolution 2K, texte précis et photoréalisme. Le mode Thinking (réservé aux abonnés ChatGPT Plus, Pro, Business et Enterprise) active la couche de raisonnement : le modèle planifie la composition, cherche des références visuelles réelles sur le web, génère jusqu’à 8 images cohérentes par lot avec des personnages constants et vérifie le résultat avant de finir. Pour la plupart des besoins en image unique, le mode Instant suffit.

Non, et DALL-E 3 a d’ailleurs été retiré (12 mai 2026). GPT Image 2 repose sur une architecture entièrement nouvelle d’OpenAI, ce n’est pas une mise à jour de DALL-E. Les principales différences : GPT Image 2 produit jusqu’à 2K (2048px) contre 1024px pour DALL-E 3 ; son rendu du texte est quasi parfait là où DALL-E 3 était peu fiable ; il accepte tous les formats de 3:1 à 1:3 ; et c’est le premier modèle d’image doté d’un raisonnement natif.

Non : gpt-image-2 ne prend pas en charge les fonds transparents (PNG avec canal alpha). Si vous avez besoin d’éléments détourés, utilisez GPT Image 1 ou 1.5, ou retouchez l’image dans Photoshop/Figma. Pour une photo produit sur fond blanc, ajoutez plutôt au prompt "on a pure white background, studio lighting".

Chaque génération avec GPT Image 2 coûte 5 crédits. Ce coût plus élevé reflète l’intensité de calcul de GPT Image 2 par rapport à des modèles plus simples : son inférence est bien plus complexe, surtout en haute qualité. Vous pouvez recharger vos crédits sur notre page de tarifs.

Nettement supérieure à celle de tous les modèles d’image précédents d’OpenAI. Lors des tests pratiques de PixVerse sur 14 prompts d’affiches et de typographie, 19 générations riches en texte sur 20 ont donné un texte lisible et sans faute dès le premier essai. Le modèle gère les écritures latines de façon quasi parfaite en 2K et atteint une précision au caractère près pour les écritures non latines comme le japonais, le coréen, le chinois, l’hindi et le bengali.

La reproduction des logos de marque n’est pas fiable. La génération est plus lente qu’avec des modèles légers comme FLUX Schnell. Pas de fond transparent. La politique de contenu est plus stricte que celle des alternatives open source. Les tâches complexes liées au monde physique (étapes d’origami, schémas de Rubik’s Cube, surfaces inversées ou inclinées) peuvent encore échouer. Les détails fins très denses ou répétitifs peuvent perdre en cohérence.

Écrivez comme un réalisateur qui briefe un photographe. Suivez la formule : [Style/Technique] + [Sujet] + [Décor] + [Éclairage] + [Composition] + [Caractéristiques techniques]. Placez les détails les plus importants dans les 50 premiers mots. Indiquez le format explicitement ("aspect ratio 9:16"). Pour un texte exact, ajoutez "All text must be fully accurate" à la fin.

Aussi appelé

gpt image 2gpt image 2 gratuitchatgpt imagegénérateur d’image chatgptcréer une image avec chatgptchat gpt image gratuitgénérer une image avec chat gptchatgpt pour créer des imagesopenai générateur d’imagesgpt image en ligne