GPT Image 2
Le modèle de génération d’images le plus performant d’OpenAI : qualité photoréaliste, rendu du texte quasi parfait et respect exemplaire des consignes. Sorti le 21 avril 2026. La même IA que celle de ChatGPT Images 2.0.
exemples





Qu’est-ce que GPT Image 2 ?
GPT Image 2 (nom officiel dans l’API : gpt-image-2) a été lancé par OpenAI le 21 avril 2026 sous le nom ChatGPT Images 2.0, successeur direct de GPT Image 1.5 (décembre 2025). C’est l’avancée la plus importante de la famille GPT Image et, avec le retrait programmé de DALL-E 2 et DALL-E 3 en mai 2026, désormais l’unique plateforme de génération d’images d’OpenAI.
La grande nouveauté ne tient pas qu’à la qualité d’image : c’est le raisonnement. GPT Image 2 est le premier modèle d’image d’OpenAI doté d’une capacité native de « réflexion » : en mode Thinking, il planifie la composition, cherche des références réelles sur le web et vérifie lui-même son résultat avant de le finaliser. OpenAI le décrit comme un « partenaire de réflexion visuelle » conçu pour les workflows de production.
Quoi de neuf dans GPT Image 2 ?
Par rapport à GPT Image 1.5, GPT Image 2 apporte :
- Raisonnement natif (mode Thinking) : le modèle planifie avant de dessiner, une première pour un modèle d’image d’OpenAI. Il organise la mise en page, cherche sur le web, puis vérifie son propre résultat.
- Résolution native 2K (2048px) : supprime l’étape d’agrandissement qui dégradait la qualité dans les workflows précédents.
- Rendu du texte quasi parfait : 19 prompts riches en texte sur 20 donnent un texte lisible dès le premier essai (tests pratiques de PixVerse). Gère désormais le japonais, le coréen, le chinois, l’hindi et le bengali.
- Tous les formats (de 3:1 à 1:3) : des bannières ultra-larges aux écrans mobiles tout en hauteur, sans formats prédéfinis.
- Lots de plusieurs images (jusqu’à 8) : générez une BD complète, un storyboard ou une campagne avec des personnages cohérents à partir d’un seul prompt (mode Thinking).
GPT Image 2 face aux anciens modèles d’OpenAI
DALL-E 2 et DALL-E 3 ont été retirés le 12 mai 2026. GPT Image 2 est désormais l’unique plateforme de génération d’images d’OpenAI.
| Fonctionnalité | DALL-E 3 | GPT Image 1/1.5 | GPT Image 2 ✦ |
|---|---|---|---|
| Raisonnement natif / Thinking | ✗ | ✗ | ✓ Une première |
| Résolution max. | 1024px | 1536px | 2048px (2K) |
| Précision du rendu du texte | Faible | Moyenne | Quasi parfaite (19/20) |
| Texte CJK / hindi / bengali | ✗ | Limité | ✓ Précis au caractère près |
| Plage de formats | Formats fixes | Formats fixes | 3:1 → 1:3 (au choix) |
| Lots de plusieurs images | ✗ | ✗ | Jusqu’à 8 (Thinking) |
| Recherche web pendant la génération | ✗ | ✗ | ✓ (mode Thinking) |
| Retouche d’images | ✗ | ✓ (1.5) | ✓ Avancée |
| Fond transparent | ✓ | ✓ | ✗ Non pris en charge |
| Métadonnées de provenance C2PA | ✗ | Partielles | ✓ Sur toutes les images |
Fonctionnalités clés
Mode Thinking natif
Le premier modèle d’image d’OpenAI capable de raisonner. Il planifie la composition, cherche des références sur le web et vérifie son résultat avant de finir, ce qui augmente fortement le taux de réussite du premier coup sur les prompts complexes.

Rendu du texte précis
19 générations riches en texte sur 20 sont lisibles dès le premier essai (tests PixVerse). Gère les titres sur plusieurs lignes, les écritures non latines, les mises en page multilingues et les textes d’interface denses.

Rendu photoréaliste
Restitue la texture de la peau, les reflets des matières, le grain, la profondeur de champ et les subtiles imperfections de la lumière. Canva y voit « du raisonnement créatif et du goût en design : ce tournant vient d’avoir lieu ».

Résolution 2K et tous les formats
Sortie native en 2048px. Prend en charge tous les formats, du 3:1 ultra-large (bannières) au 1:3 ultra-haut (écrans mobiles), sans l’étape d’agrandissement qui dégradait la qualité dans les workflows précédents.

Génération de plusieurs images par lot
Générez jusqu’à 8 images cohérentes à partir d’un seul prompt, avec des personnages constants sur tout le lot (mode Thinking). Un prompt → une BD, un storyboard ou une campagne complets.

Provenance C2PA et sécurité
Chaque image GPT Image 2 intègre des métadonnées C2PA, une preuve vérifiable par machine que l’image a été générée par IA. La modération est stricte mais laisse une large place à la création.

Guide des prompts GPT Image 2
Des prompts performants classés par catégorie. Copiez-en un et collez-le dans le générateur à gauche.
Portrait cinématographique
Affiche et design riches en texte
Personnages et design d’interface
Infographie et expérimental
La formule du prompt
Écrivez comme un réalisateur qui briefe un photographe. Placez les détails essentiels dans les 50 premiers mots.
[Style/Technique] + [Sujet] + [Décor] + [Éclairage] + [Composition] + [Caractéristiques techniques]
Qui utilise GPT Image 2, et pourquoi
E-commerce et équipes produit
Générez des visuels principaux, des photos lifestyle et des packshots sur fond sans passer par un studio. Grâce au photoréalisme de GPT Image 2, les images peuvent aller directement dans vos fiches Shopify ou vos pages produit Amazon.
Community managers
Créez des visuels uniques et fidèles à votre marque, à grande échelle. Le texte étant précis, vous pouvez générer des visuels de posts avec le texte incrusté, là où la plupart des modèles d’IA échouent.
Écrivains et auteurs
Générez des illustrations de couverture, des références de personnages, des visualisations de scènes et des couvertures de livres. Dans bien des cas, la qualité des portraits rivalise avec une illustration de commande.
Architectes et designers
Visualisez concepts d’intérieur, associations de matériaux et agencements avant de passer en production. Une idéation rapide pour une fraction du coût d’un rendu 3D.
Enseignants et chercheurs
Créez des schémas illustrés, des reconstitutions de scènes historiques et des supports pédagogiques visuels. Des laboratoires de recherche utilisent GPT Image 2 pour étudier à grande échelle les contenus générés par IA.
Équipes marketing et marque
Visualisez rapidement vos concepts de campagne. Générez plusieurs pistes créatives en quelques minutes, présentez-les aux décideurs et n’investissez que dans les meilleures idées.
GPT Image 2 dans la recherche académique
Arxiv · 2604.25213 · avril 2026
When the Forger Is the Judge: GPT-Image-2 Cannot Recognize Its Own Faked Documents
Cette étude montre la capacité de GPT Image 2 à générer des documents photoréalistes, si réalistes que le modèle lui-même ne parvient pas à les identifier comme générés par IA. Elle souligne le photoréalisme sans précédent du modèle et soulève des questions importantes sur l’authentification des documents.
Arxiv · 2604.25370 · avril 2026
GPT-Image-2 in the Wild: A Twitter Dataset of Self-Reported AI-Generated Images from the First Week of Deployment
Les chercheurs ont collecté et analysé des milliers d’images partagées publiquement sur Twitter durant la première semaine de déploiement de GPT Image 2. Le jeu de données documente les usages réels, les catégories créatives les plus populaires et la diffusion des contenus générés par IA sur les réseaux sociaux.
Questions fréquentes
GPT Image 2 (nom officiel dans l’API : gpt-image-2, aussi commercialisé sous le nom ChatGPT Images 2.0) est le modèle de génération d’images le plus avancé d’OpenAI, sorti le 21 avril 2026. C’est le successeur direct de GPT Image 1.5 (décembre 2025) et, depuis le retrait de DALL-E 2 et DALL-E 3 en mai 2026, l’unique plateforme de génération d’images d’OpenAI. C’est aussi le premier modèle d’image d’OpenAI doté d’une capacité native de « réflexion » : il planifie, cherche sur le web et se vérifie avant de finaliser une image.
GPT Image 2 propose deux modes. Le mode Instant, accessible à tous les utilisateurs, y compris en version gratuite, apporte les principales améliorations de qualité : résolution 2K, texte précis et photoréalisme. Le mode Thinking (réservé aux abonnés ChatGPT Plus, Pro, Business et Enterprise) active la couche de raisonnement : le modèle planifie la composition, cherche des références visuelles réelles sur le web, génère jusqu’à 8 images cohérentes par lot avec des personnages constants et vérifie le résultat avant de finir. Pour la plupart des besoins en image unique, le mode Instant suffit.
Non, et DALL-E 3 a d’ailleurs été retiré (12 mai 2026). GPT Image 2 repose sur une architecture entièrement nouvelle d’OpenAI, ce n’est pas une mise à jour de DALL-E. Les principales différences : GPT Image 2 produit jusqu’à 2K (2048px) contre 1024px pour DALL-E 3 ; son rendu du texte est quasi parfait là où DALL-E 3 était peu fiable ; il accepte tous les formats de 3:1 à 1:3 ; et c’est le premier modèle d’image doté d’un raisonnement natif.
Non : gpt-image-2 ne prend pas en charge les fonds transparents (PNG avec canal alpha). Si vous avez besoin d’éléments détourés, utilisez GPT Image 1 ou 1.5, ou retouchez l’image dans Photoshop/Figma. Pour une photo produit sur fond blanc, ajoutez plutôt au prompt "on a pure white background, studio lighting".
Chaque génération avec GPT Image 2 coûte 5 crédits. Ce coût plus élevé reflète l’intensité de calcul de GPT Image 2 par rapport à des modèles plus simples : son inférence est bien plus complexe, surtout en haute qualité. Vous pouvez recharger vos crédits sur notre page de tarifs.
Nettement supérieure à celle de tous les modèles d’image précédents d’OpenAI. Lors des tests pratiques de PixVerse sur 14 prompts d’affiches et de typographie, 19 générations riches en texte sur 20 ont donné un texte lisible et sans faute dès le premier essai. Le modèle gère les écritures latines de façon quasi parfaite en 2K et atteint une précision au caractère près pour les écritures non latines comme le japonais, le coréen, le chinois, l’hindi et le bengali.
La reproduction des logos de marque n’est pas fiable. La génération est plus lente qu’avec des modèles légers comme FLUX Schnell. Pas de fond transparent. La politique de contenu est plus stricte que celle des alternatives open source. Les tâches complexes liées au monde physique (étapes d’origami, schémas de Rubik’s Cube, surfaces inversées ou inclinées) peuvent encore échouer. Les détails fins très denses ou répétitifs peuvent perdre en cohérence.
Écrivez comme un réalisateur qui briefe un photographe. Suivez la formule : [Style/Technique] + [Sujet] + [Décor] + [Éclairage] + [Composition] + [Caractéristiques techniques]. Placez les détails les plus importants dans les 50 premiers mots. Indiquez le format explicitement ("aspect ratio 9:16"). Pour un texte exact, ajoutez "All text must be fully accurate" à la fin.
Aussi appelé