imágenes de entrada opcional
prompt obligatorio
ajustes

GPT Image 2

El modelo de generación de imágenes más potente de OpenAI: calidad fotorrealista, texto casi perfecto y un seguimiento de instrucciones de primer nivel. Lanzado el 21 de abril de 2026. La misma IA que impulsa ChatGPT Images 2.0.

ejemplos

Joyería creada con GPT Image 2Retrato generado con GPT Image 2Plano medio general cinematográfico a la altura de los ojos creado con GPT Image 2Póster publicitario comercial creativo creado con GPT Image 2Anuncio tipo collage de moda de lujo creado con GPT Image 2
Resolución 2KTexto precisoFotorrealistaCualquier relación de aspectoModo Thinking

¿Qué es GPT Image 2?

GPT Image 2 (nombre oficial en la API: gpt-image-2) fue lanzado por OpenAI el 21 de abril de 2026 como ChatGPT Images 2.0, sucesor directo de GPT Image 1.5 (diciembre de 2025). Es el mayor salto de la familia GPT Image y, con la retirada programada de DALL-E 2 y DALL-E 3 en mayo de 2026, la única plataforma de generación de imágenes de OpenAI de aquí en adelante.

La gran novedad no es solo la calidad de imagen, sino el razonamiento. GPT Image 2 es el primer modelo de imagen de OpenAI con capacidad nativa de "pensar": en el modo Thinking planifica la composición, busca referencias reales en la web y revisa su propio resultado antes de darlo por terminado. OpenAI lo describe como un "compañero de pensamiento visual" pensado para flujos de trabajo profesionales.

2K
Resolución nativa
Salida de 2048px
19/20
Precisión del texto
Legible al primer intento (pruebas de PixVerse)
3:1→1:3
Relaciones de aspecto
Cualquier formato
8×
Generación por lotes
Personajes coherentes (modo Thinking)

¿Qué hay de nuevo en GPT Image 2?

Frente a GPT Image 1.5, GPT Image 2 incorpora:

  • Razonamiento nativo (modo Thinking): el modelo planifica antes de dibujar, algo inédito en un modelo de imagen de OpenAI. Organiza la composición, busca en la web y luego verifica su propio resultado.
  • Resolución nativa 2K (2048px): elimina el paso de reescalado que degradaba la calidad en flujos anteriores.
  • Texto casi perfecto: 19 de cada 20 prompts con mucho texto devuelven texto legible al primer intento (pruebas prácticas de PixVerse). Ahora también maneja japonés, coreano, chino, hindi y bengalí.
  • Cualquier relación de aspecto (de 3:1 a 1:3): desde banners ultrapanorámicos hasta pantallas móviles verticales, sin formatos fijos.
  • Lotes de varias imágenes (hasta 8): genera un cómic completo, un storyboard o una campaña con personajes coherentes a partir de un solo prompt (modo Thinking).

GPT Image 2 frente a modelos anteriores de OpenAI

DALL-E 2 y DALL-E 3 se retiraron el 12 de mayo de 2026. GPT Image 2 es ahora la única plataforma de generación de imágenes de OpenAI.

FunciónDALL-E 3GPT Image 1/1.5GPT Image 2 ✦
Razonamiento nativo / Thinking✗✗✓ El primero
Resolución máxima1024px1536px2048px (2K)
Precisión del textoDeficienteModeradaCasi perfecta (19/20)
Texto CJK / hindi / bengalí✗Limitado✓ Preciso a nivel de carácter
Rango de relaciones de aspectoFormatos fijosFormatos fijos3:1 → 1:3 (cualquiera)
Lotes de varias imágenes✗✗Hasta 8 (Thinking)
Búsqueda web durante la generación✗✗✓ (modo Thinking)
Edición de imágenes✗✓ (1.5)✓ Avanzada
Fondo transparente✓✓✗ No compatible
Metadatos de procedencia C2PA✗Parcial✓ En todas las imágenes

Funciones clave

Modo Thinking nativo

El primer modelo de imagen de OpenAI con razonamiento. Planifica la composición, busca referencias en la web y verifica su resultado antes de terminar, lo que dispara la tasa de acierto al primer intento con prompts complejos.

Explicación de un problema de matemáticas creada con GPT Image 2

Texto preciso en las imágenes

19 de cada 20 generaciones con mucho texto salen legibles al primer intento (pruebas de PixVerse). Maneja titulares de varias líneas, alfabetos no latinos, composiciones en varios idiomas y textos de interfaz densos.

Tipografía impecable en varios idiomas creada con GPT Image 2

Resultados fotorrealistas

Reproduce la textura de la piel, el reflejo de los materiales, el grano, la profundidad de campo y sutiles imperfecciones de la luz. Canva lo resumió así: "razonamiento creativo y gusto por el diseño: ese cambio acaba de ocurrir".

Selfi hiperrealista frente al espejo de una joven en un lujoso baño de mármol beige por la noche, creado con GPT Image 2

Resolución 2K y cualquier relación de aspecto

Salida nativa de 2048px. Admite cualquier relación de aspecto, desde 3:1 ultrapanorámico (banners) hasta 1:3 ultravertical (pantallas móviles), sin el reescalado que degradaba la calidad en flujos anteriores.

Póster de unboxing de lujo con gran nivel de detalle creado con GPT Image 2

Generación por lotes de varias imágenes

Genera hasta 8 imágenes coherentes a partir de un solo prompt, con personajes consistentes en todo el lote (modo Thinking). Un prompt → un cómic, un storyboard o una campaña completos.

Ídolo coreana ficticia de unos 25 años creada con GPT Image 2

Procedencia C2PA y seguridad

Cada imagen de GPT Image 2 incluye metadatos C2PA, una prueba verificable por máquina de que fue generada por IA. La moderación de contenido es estricta, pero permite un amplio uso creativo.

Seguridad de GPT Image según la System Card de ChatGPT Image 2

Guía de prompts para GPT Image 2

Prompts de alto rendimiento organizados por categoría. Copia cualquiera y pégalo en el generador de la izquierda.

Retrato cinematográfico

“A photorealistic candid travel scene of a person standing at a coastal roadside turnout on an overcast morning, shot on 35mm film. Natural imperfect framing, visible grain, ambient light, muted colors, wind in clothing and hair, cinematic realism.”
“35mm film photography, warm natural window light. A young woman sitting in a vintage bookshop, reading a hardcover book. Soft afternoon sunlight filtering through dusty windows. Medium shot, slightly off-center composition. Aspect ratio 3:4.”
“A photorealistic snapshot portrait of two friends outside a venue at night, shot on a compact point-and-shoot camera with direct flash. Crisp foreground detail, deep shadow falloff, spontaneous energy, early-2000s flash photograph aesthetic.”

Póster y diseño con mucho texto

“A striking Spring 2026 city poster for New York with a bold contemporary design. Typography reads "SPRING 2026" with slogan "NEW YORK — A CITY OF BRIDGES, DREAMS, AND REINVENTION". Text must be sharp and beautifully composed. Aspect ratio 9:16.”
“"japanese-manga-style disassembly" of a basketball dunk shoot motion like a time lapse. Tell the most story through visuals rather than text. 3:1 ultrawide aspect ratio. Prefer light background rather than dark.”
“A premium Japanese restaurant menu printed on dark washi paper. The restaurant name "黒松" (Kuromatsu) in large calligraphic brushstroke lettering. Omakase Course with five dishes, Japanese names on the left and English on the right. All text must be fully accurate.”

Diseño de personajes y UI

“Professional character reference sheet for a young female mage with silver hair and violet eyes, ornate dark cloak with glowing rune patterns. Three-view turnaround, facial expression variations, costume breakdown, color palette swatch row. Aspect ratio 16:9.”
“A hyper-realistic iPhone screenshot of a fictional Instagram profile for Leonardo da Vinci, username @davinci_official, as a modern influencer. 9 posts showing Mona Lisa as a mirror selfie, helicopter sketch as a drone design drop, anatomy studies as gym progress. Dark mode. Aspect ratio 9:16.”
“Make an advertisement for a matcha shop called "kizuki" opening in Brooklyn Heights. Sunlit strawberry matcha (iced), streetwear aesthetic with Japanese minimalism. Square format for Instagram feed.”

Infografía y experimental

“Cantor's diagonalization proof, rendered as a clean educational infographic. Clearly labeled diagram showing the diagonal argument, precise mathematical notation, and brief explanatory annotations. Light background, structured layout. Aspect ratio 4:3.”
“Inside a museum exhibit titled "Ancient Technology: The Desktop Era", a programmer in a glass display case is live-demonstrating coding on a CRT monitor while amazed schoolchildren press their faces against the glass. 2D cartoon illustration style, warm museum lighting. Aspect ratio 16:9.”
“A sample page of a colorized Japanese shonen adventure manga. The main character finds a magical quill with an OpenAI logo. Make it dramatic. All dialogue and text in Japanese. The page should appear as a photo of a physical page. Aspect ratio 9:16.”

La fórmula del prompt

Escribe como un director que da indicaciones a un fotógrafo. Pon los detalles clave en las primeras 50 palabras.

[Estilo/Técnica] + [Sujeto] + [Escenario] + [Iluminación] + [Composición] + [Especificaciones técnicas]

Quién usa GPT Image 2 y por qué

E-commerce y equipos de producto

Genera imágenes principales, fotos de estilo de vida y fotografía de producto con fondo sin necesidad de estudio. Gracias al fotorrealismo de GPT Image 2, los resultados pueden ir directos a fichas de Shopify o páginas de producto de Amazon.

Community managers

Crea visuales únicos y fieles a la marca a gran escala. Como el texto sale preciso, puedes generar gráficos para publicaciones con el copy superpuesto, algo en lo que fallan la mayoría de modelos de IA.

Escritores y autores

Genera ilustraciones de portada, imágenes de referencia de personajes, visualizaciones de escenas y portadas de libros. En muchos casos, la calidad de los retratos rivaliza con la de una ilustración por encargo.

Arquitectos y diseñadores

Visualiza conceptos de interiorismo, combinaciones de materiales y distribuciones espaciales antes de pasar a producción. Ideación rápida por una fracción de lo que cuesta un render 3D.

Docentes e investigadores

Crea diagramas ilustrados, reconstrucciones de escenas históricas y materiales didácticos visuales. Los laboratorios de investigación usan GPT Image 2 para estudiar el contenido generado por IA a gran escala.

Equipos de marketing y marca

Visualización rápida de conceptos para campañas. Genera varias direcciones creativas en minutos, preséntalas a los interesados e invierte solo en las ideas más fuertes.

GPT Image 2 en la investigación académica

Preguntas frecuentes

GPT Image 2 (nombre oficial en la API: gpt-image-2, también comercializado como ChatGPT Images 2.0) es el modelo de generación de imágenes más avanzado de OpenAI, lanzado el 21 de abril de 2026. Es el sucesor directo de GPT Image 1.5 (diciembre de 2025) y, tras la retirada de DALL-E 2 y DALL-E 3 en mayo de 2026, la única plataforma de generación de imágenes de OpenAI. Es el primer modelo de imagen de OpenAI con capacidad nativa de "pensar": planifica, busca en la web y se revisa a sí mismo antes de dar por terminada una imagen.

GPT Image 2 tiene dos modos. El modo Instant, disponible para todos los usuarios, incluido el plan gratuito, ofrece las mejoras de calidad principales: resolución 2K, texto preciso y fotorrealismo. El modo Thinking (para suscriptores de ChatGPT Plus, Pro, Business y Enterprise) activa la capa de razonamiento: el modelo planifica la composición, busca referencias visuales reales en la web, genera hasta 8 imágenes coherentes en un lote con personajes consistentes y verifica el resultado antes de terminar. Para la mayoría de necesidades de una sola imagen, el modo Instant es suficiente.

No, y de hecho DALL-E 3 ya se ha retirado (12 de mayo de 2026). GPT Image 2 es una arquitectura totalmente nueva de OpenAI, no una actualización de DALL-E. Las diferencias clave: GPT Image 2 genera hasta 2K (2048px) frente a los 1024px de DALL-E 3; reproduce el texto casi a la perfección, donde DALL-E 3 era poco fiable; admite cualquier relación de aspecto de 3:1 a 1:3; y es el primer modelo de imagen con razonamiento nativo.

No: gpt-image-2 no admite fondos transparentes (PNG con canal alfa). Si necesitas recortes sin fondo, tendrás que usar GPT Image 1 o 1.5, o retocar el resultado en Photoshop/Figma. Para fotografía de producto con fondo blanco, pide en el prompt "on a pure white background, studio lighting".

Cada generación con GPT Image 2 cuesta 5 créditos. El coste más alto refleja la carga computacional de GPT Image 2 frente a modelos más sencillos: ejecuta una inferencia mucho más compleja, sobre todo en calidad alta. Puedes recargar créditos en nuestra página de precios.

Mucho mejor que el de cualquier modelo de imagen anterior de OpenAI. En las pruebas prácticas de PixVerse con 14 prompts de pósteres y tipografía, 19 de 20 generaciones con mucho texto devolvieron un texto legible y bien escrito al primer intento. El modelo maneja los alfabetos latinos casi a la perfección en 2K y logra precisión a nivel de carácter en escrituras no latinas como el japonés, el coreano, el chino, el hindi y el bengalí.

Reproducir logotipos de marcas no es fiable. Genera más despacio que modelos ligeros como FLUX Schnell. No admite fondos transparentes. Su política de contenido es más estricta que la de las alternativas de código abierto. Las tareas complejas del mundo físico (pasos de origami, diagramas del cubo de Rubik, superficies invertidas o en ángulo) todavía pueden salir mal. Los detalles finos muy densos o repetitivos pueden perder coherencia.

Escribe como un director que da indicaciones a un fotógrafo. Usa la fórmula: [Estilo/Técnica] + [Sujeto] + [Escenario] + [Iluminación] + [Composición] + [Especificaciones técnicas]. Pon los detalles más importantes en las primeras 50 palabras. Indica la relación de aspecto de forma explícita ("aspect ratio 9:16"). Para que el texto salga exacto, añade al final "All text must be fully accurate".

También conocido como

gpt image 2gpt image 2 gratischatgpt imagenesgenerador de imágenes chatgptcrear imágenes con chatgptchat gpt imagengenerar imágenes con chat gptchatgpt para crear imágenesopenai generador de imágenesgpt image online