Seis grados de calidad
Baja (low), media (medium), alta (high), muy alta (xhigh), máxima (max) y automática (auto). Los dos grados superiores son nuevos en 2.5.
ChatGPT Images 2.5 de OpenAI llega a Virse en sus dos ediciones de API, GPT Image 2.5 Flare y GPT Image 2.5 Sunburst, con seis grados de calidad y salida de hasta 4K.
Abre esta página en un navegador de escritorio para empezar a crear.
ChatGPT Images 2.5 se lanzó el 8 de septiembre de 2026 como dos modelos en lugar de uno, y la diferencia entre ellos es el tiempo.
GPT Image 2.5 Flare es el rápido, que OpenAI describe como la opción predeterminada para la mayoría de las aplicaciones. GPT Image 2.5 Sunburst tarda más por imagen y está diseñado para trabajos en los que la precisión de la edición es lo más importante. En la mayoría de las plataformas esa elección también es una cuestión de presupuesto, y la edición precisa se convierte discretamente en la que reservas para el render final.
En Virse, los dos aparecen en el mismo menú de modelos y cuestan el mismo número de créditos en todos los grados de calidad, desde 1K Low hasta 4K Max. Haz el borrador en Flare porque vuelve antes, pasa a Sunburst cuando la imagen tenga que resistir una mirada de cerca y deja que decida el trabajo en lugar de la factura.

ChatGPT Images 2.5 es el modelo de imágenes de OpenAI lanzado el 8 de septiembre de 2026, disponible para todos los usuarios de ChatGPT, ChatGPT Work y Codex en todos los niveles en escritorio, móvil y web. OpenAI resume el lanzamiento como detalles más nítidos, edición más precisa y generación más rápida.
El nombre funciona en dos niveles. ChatGPT Images 2.5 es el nombre del producto dentro de ChatGPT. En la API, y en Virse, la misma generación aparece como dos modelos: gpt-image-2.5-flare y gpt-image-2.5-sunburst, ambos con una fecha de instantánea 2026-09-08.
OpenAI menciona tres mejoras respecto a la generación anterior:
Junto con el modelo, OpenAI presentó Sketch, plantillas, ediciones basadas en comentarios y uso compartido de prompts. Estas cuatro son funciones de la interfaz de ChatGPT, no parámetros del modelo, y no son lo que Virse expone. Lo que Virse expone es el propio modelo, con los grados de calidad, tamaños y comportamiento de imágenes de referencia descritos en la propia documentación de OpenAI.
Esta página es para quienes están decidiendo si trasladar el trabajo de imágenes en producción a 2.5, y a cuál de las dos ediciones dirigirlo.

Baja (low), media (medium), alta (high), muy alta (xhigh), máxima (max) y automática (auto). Los dos grados superiores son nuevos en 2.5.
El recuento total de píxeles va de 655.360 a 8.294.400, sin que ningún lado supere los 3840 píxeles.
Cualquier WIDTHxHEIGHT con ambos lados como múltiplo de 16 y una relación de aspecto entre 1:3 y 3:1.
Se aceptan tanto briefings escritos como imágenes de referencia. La salida siempre es una imagen.
Establece el fondo como transparente y recibe el resultado en PNG o WebP, sin un paso adicional de creación de máscara.
gpt-image-2.5-flare y gpt-image-2.5-sunburst, ambos con instantánea fechada el 08-09-2026.

OpenAI creó 2.5 para trabajar mejor a partir de fotos de referencia, manteniendo los rasgos distintivos cuando un sujeto se traslada a un nuevo entorno, estilo o composición. La misma cara, la misma botella, la misma habitación, en otro lugar.

Pide un cambio y es más probable que el resto del encuadre permanezca en su sitio. OpenAI describe el modelo como mejor a la hora de editar solo lo que has pedido, manteniendo igual el detalle circundante, incluso en sujetos y fondos complejos.

Las sesiones de edición largas solían degradarse. OpenAI dice que ahora los cambios anteriores se mantienen a medida que llegan otros nuevos, de modo que la décima revisión sigue incorporando las nueve primeras en lugar de deshacerlas silenciosamente.

El modelo interpreta con más precisión instrucciones visuales complejas y refleja con mayor fidelidad un estilo visual descrito, algo que se aprecia sobre todo en las superficies: tela, piel, metal y cualquier cosa iluminada desde una dirección que hayas especificado.

Las disposiciones densas mantienen su jerarquía, y los fondos transparentes se tratan como parte del diseño en lugar de como una ocurrencia de última hora. Los recursos recortados salen listos para colocar.

OpenAI informa de una reducción de la latencia de generación de imágenes de hasta un 50% frente a Images 2.0. Flare incorpora esa mejora; Sunburst la sacrifica a cambio de precisión.
Ambas ediciones 2.5 aceptan los mismos parámetros y cuestan los mismos créditos en Virse. Lo que las diferencia es cuánto tarda cada imagen.
| Dimensión | GPT Image 2.5 Flare | GPT Image 2.5 Sunburst | GPT Image 2 | Fuente |
|---|---|---|---|---|
| Descripción de OpenAI | "Generación de imágenes rápida y de alta calidad para el día a día" | "Nuestro modelo más capaz para la generación y edición de imágenes" | La generación anterior, todavía seleccionable en Virse | Fuente |
| Creado para | La opción predeterminada para la mayoría de trabajos, desde contenido para redes sociales hasta ejecuciones de gran volumen | Trabajo visual premium que se beneficia de un control más preciso en las ediciones | Briefs extensos con múltiples restricciones | Fuente |
| Grados de calidad | Seis, hasta el máximo | Seis, hasta el máximo | Tres, hasta High | Fuente |
| Velocidad | Latencia hasta un 50% menor que Images 2.0 | Tiempos de generación más largos, a cambio de precisión | Base | Fuente |
| Créditos en 2K High en Virse | 18 | 18 | 36 | Fuente |
| Créditos en 2K Max en Virse | 69 | 69 | Grado no disponible | Fuente |
El trabajo guiado por referencias rara vez es un solo prompt. Es una foto, una norma de marca, cuatro intentos y una nota de otra persona sobre el tercero. Virse lo mantiene todo en un único lienzo. La referencia a partir de la que generaste, el briefing que escribiste y cada versión que volvió permanecen una al lado de la otra, de modo que comparar un resultado con su fuente es cuestión de echar un vistazo, no de buscar archivos.
Coloca la foto de origen en el lienzo junto a las generaciones que produjo, y evalúa la fidelidad del sujeto mirando ambas a la vez.

Define la composición en la edición rápida y luego vuelve a ejecutar el briefing acordado en Sunburst. El coste en créditos por imagen es el mismo en todos los grados, así que solo cambia la espera.

Muévete entre ChatGPT Images 2.5 y más de 30 modelos de imagen y vídeo sin salir del lienzo ni reescribir el briefing.

Cada revisión aparece junto a la anterior, de modo que una sesión de edición de diez turnos sigue siendo legible y puedes volver al turno cuatro sin regenerarlo.


Trabajo en serie en el que cada recurso debe mantener la misma dirección visual, jerarquía y tratamiento.

Una única fotografía de producto colocada en tantos entornos, estaciones y superficies como necesite la campaña.

Diseños de frontal de envase con nombres exactos de producto, descriptores y textos legalmente requeridos.

Elementos con fondo transparente para presentaciones, banners y composiciones que no requieren crear una máscara después.

Gráficos de procesos y secciones transversales en los que las etiquetas deben ser correctas, no decorativas.

Fotografías de personas y lugares reales trasladados a nuevos entornos mientras el sujeto sigue siendo reconocible.
Selecciona el modelo en el menú. Empieza con Flare mientras aún se está decidiendo la imagen, ya que devuelve resultados antes con el mismo coste en créditos.
Sube las fotos y nombra cada una según su propósito: esta es el sujeto, esta es el estilo, esta es el fondo. Indica cómo deben combinarse.
Describe el resultado y su uso previsto; luego enumera qué no debe cambiar y qué no debe aparecer. Pon entre comillas cualquier palabra que deba aparecer en la imagen.
Vuelve a enviar la salida como entrada para la siguiente edición, pide un único cambio y repite los detalles que quieres conservar.
La propia guía de prompts de OpenAI para 2.5 construye un prompt a partir de seis partes, en este orden. Escribir las restricciones una vez es lo que te permite volver a formularlas cuando una edición posterior se desvía.
En lugar de escribir
Haz una buena foto de producto de la botella sobre un fondo bonito, con aspecto profesional.
Escribe
Una fotografía de producto para un anuncio de comercio electrónico, cuadrada, con la botella centrada y ocupando el 70 por ciento central del encuadre. Vidrio ámbar, tapón de aluminio cepillado, condensación en el tercio inferior. Fondo de papel mate de color arena, una luz suave desde la parte superior izquierda, una única sombra suave proyectada hacia la derecha. La etiqueta frontal dice "NORTH FIELD" en versalitas a lo largo del tercio superior y "500 ml" en el borde inferior. La referencia 1 es la botella y el diseño gráfico de su etiqueta; conserva la geometría y la tipografía de la etiqueta exactamente como se han proporcionado. Sin texto adicional, sin logotipos, sin marca de agua.

Una fotografía del jarrón de cerámica de la Referencia 1, trasladado al alféizar de una ventana soleada en una habitación blanca enlucida, tomada de frente desde dos metros de distancia a la altura de los ojos. Luz de última hora de la tarde entrando desde la derecha en un ángulo bajo, proyectando la sombra del marco de la ventana sobre la pared de detrás. Mantén el color del esmalte del jarrón, el patrón de craquelado y las proporciones del cuello exactamente como aparecen en la referencia. Cambia solo el entorno y la luz. Sin objetos adicionales en el alféizar. Sin texto, sin logotipos, sin marca de agua.

Un póster en una composición plana para una panadería de barrio, en orientación vertical, fotografiado directamente desde arriba sobre una mesa de nogal oscuro. En el tercio superior, las palabras "FIELD AND FLOUR" en una tipografía serif ancha, con espaciado entre letras, en color crema. Debajo, "Abierto desde las seis" en cursiva pequeña, a un tercio del tamaño. En el borde inferior, "N.º 41 Bridge Street" en versalitas. Una hogaza de masa madre rasgada en la parte inferior izquierda, un paño de lino doblado dos veces a la derecha, harina espolvoreada de forma irregular por el cuarto inferior. Una luz cenital ligeramente detrás del sujeto, sombras largas y suaves hacia la cámara. Ningún otro texto en ninguna parte del encuadre.

Un único par de zapatillas de running, vista de tres cuartos desde la parte delantera izquierda, colocadas en plano con la zapatilla izquierda solapándose ligeramente con la derecha. Parte superior de malla en coral vivo con una mediasuela blanca y una suela exterior ámbar translúcida. Cordones atados, lengüeta erguida, sin arrugas en la puntera. Luz difusa uniforme directamente desde arriba, sin sombra proyectada, bordes limpios y completos, incluidos los cordones. Fondo transparente. Sin superficie debajo de las zapatillas, sin texto, sin logotipos, sin marca de agua.
Numéralas e indica para qué sirve cada una. Una referencia sin explicar se promedia en el resultado en lugar de usarse para aquello concreto que querías obtener de ella.
Nombra la geometría, las etiquetas, la iluminación y la identidad que deben conservarse. Luego pide el cambio. Hacerlo en ese orden es lo que mantiene las ediciones localizadas.
Conviene excluir explícitamente el texto, los logotipos y las marcas de agua no deseados. También una segunda fuente de luz que nunca pediste.
El grado de calidad cambia la renderización, no lo que contiene la imagen. Decidir el contenido en baja calidad y subir el grado después mantiene separadas esas dos cuestiones.
Sube la foto, escribe qué cambia y qué no, y sube el resultado un grado una vez acordada la imagen.