Cómo usar ChatGPT Image 2: corrige malas ediciones, errores de texto y deriva de personajes
Vincent12 min de lectura ·

ChatGPT Image 2 funciona mejor como herramienta de edición iterativa que como generador de imágenes de un solo intento. Define primero formato, diseño, sujeto, texto y restricciones; genera una versión estructural y refina elementos concretos indicando a ChatGPT qué debe permanecer intacto. El flujo más fiable es Definir → Generar → Revisar → Editar → Validar. OpenAI presentó ChatGPT Images 2.0 el 21 de abril de 2026 y actualmente está disponible en todos los planes de ChatGPT.
Lo difícil no es generar una imagen atractiva. Los equipos profesionales necesitan fidelidad del producto, coherencia de marca, control del diseño, texto preciso y una dirección creativa repetible en muchos recursos. Nuestra revisión de materiales de investigación y preguntas frecuentes de usuarios muestra que la generación de imágenes con IA resulta más útil cuando el primer prompt establece la estructura y los turnos posteriores actúan como dirección artística controlada, en vez de regeneraciones completas repetidas.
Ahí es donde Virse amplía el flujo más allá de un chat aislado. Virse está diseñado como entorno de colaboración con IA para equipos profesionales de diseño, combinando un lienzo infinito, varios agentes colaboradores, contexto compartido del proyecto y memoria a largo plazo de preferencias estéticas, reglas de marca y conocimientos del proyecto. En lugar de pedir a la IA que sustituya al diseñador con un prompt, Virse ayuda a mantener conectada la intención creativa entre referencias, iteraciones y tareas de producción. ChatGPT Image 2, Nano Banana 2 y Seedance 2.5 ya están disponibles en Virse, para explorar y comparar varios modelos de vídeo destacados dentro del mismo flujo creativo.

Cómo usar ChatGPT Image 2 en cinco pasos
Puedes crear una imagen pidiéndoselo a ChatGPT en una conversación o abriendo la experiencia Images. También puedes cargar una imagen existente y describir los cambios deseados. OpenAI confirma actualmente la creación y edición en web, iOS y Android.
Paso 1: define el recurso antes que el estilo
Empieza por el entregable: anuncio, imagen de ecommerce, concepto de packaging, infografía, miniatura, creatividad social o visual educativo. Después especifica formato, composición, sujeto, texto, fondo y elementos protegidos.
Por ejemplo:
Crea un anuncio de ecommerce en 4:5. Coloca el producto en el 45% izquierdo de la composición, reserva el lado derecho para un titular de dos líneas, usa un fondo de estudio oscuro y neutro, y conserva la forma del producto, la ubicación del logotipo, el material y las proporciones.
Esto es más controlable que pedir un «anuncio futurista prémium», porque traduce la intención en decisiones espaciales.
Paso 2: trata la primera imagen como un borrador estructural
Revisa posición del sujeto, escala, espacio negativo, jerarquía, ángulo de cámara y área de texto antes de pulir iluminación o textura. En los flujos de diseño, corregir pronto la estructura suele ser más eficiente que perfeccionar una composición atractiva pero fundamentalmente incorrecta.
Paso 3: separa lo que debe cambiar de lo que debe permanecer
Usa tres categorías de revisión:
Categoría | Ejemplo |
Debe conservarse | Forma del producto, logotipo, pose, ángulo de cámara |
Debe cambiar | Fondo, posición del titular |
Puede variar | Accesorios, sombras menores, detalles ambientales |
Paso 4: edita una variable importante cada vez
Un patrón útil de instrucción es «Mantén X sin cambios; modifica solo Y».
Por ejemplo:
Mantén sin cambios el producto, el logotipo, las proporciones, el ángulo de cámara y la dirección de la luz. Sustituye solo el fondo por un entorno de estudio de hormigón cálido.
Así resulta más fácil evaluar cada iteración e identificar dónde empieza la deriva visual.
Paso 5: valida antes de publicar
Comprueba texto, logotipos, geometría del producto, etiquetas, manos, rostros, números, gráficos, códigos QR, precios y afirmaciones. La generación de imágenes puede acelerar la producción, pero la precisión crítica para el negocio sigue necesitando control humano.
Cómo escribir mejores prompts para ChatGPT Image 2
En trabajos profesionales, un buen prompt de ChatGPT Image 2 sigue este orden:
Formato → Diseño → Sujeto → Texto exacto → Entorno → Iluminación → Estilo → Restricciones
Este marco centrado primero en el diseño es uno de los patrones más claros de los materiales de investigación, porque la composición suele importar más que los adjetivos decorativos en la primera generación.
Pon el diseño antes que el estilo visual
Un prompt débil dice:
Crea un anuncio de altavoz inalámbrico moderno y enérgico.
Una versión más sólida dice:
Crea un anuncio horizontal 16:9. Coloca el altavoz en la mitad izquierda, reserva la derecha para el titular «Sound Without Limits», usa tipografía sans serif blanca grande, fondo gris carbón y una sutil luz de contorno azul. Conserva la geometría y los controles del altavoz.
La diferencia es la información de diseño: ubicación, jerarquía, texto, dirección visual y restricciones quedan explícitos.
Especifica el texto exacto y la jerarquía
OpenAI describe Images 2.0 como una mejora en seguimiento de instrucciones, detalle, complejidad y generación de texto denso. Esto hace más prácticos los carteles, etiquetas, diagramas, anuncios, conceptos de packaging y gráficos ricos en información.
Para textos importantes, define la redacción exacta, la ubicación, la relación de tamaños y el número de líneas. Los titulares y etiquetas cortos siguen siendo mejores candidatos que los textos legales o técnicos largos, que siempre deben revisarse manualmente.
Protege los detalles del producto y la marca
Los prompts comerciales deben indicar qué no puede rediseñar la IA: proporciones, posición del logotipo, materiales, botones, etiquetas del embalaje, detalles funcionales o ángulo de cámara.
Una imagen bonita que cambia el producto real sigue siendo una imagen de producto inutilizable.
Cómo editar con ChatGPT Image 2 sin cambiar el sujeto
La clave de la edición controlada es una dirección que priorice la conservación. OpenAI admite oficialmente editar imágenes cargadas, incluidos cambios de detalles visuales, adición de texto y modificaciones del fondo.
Define la identidad antes de cambiar la escena
Para un producto:
Conserva la geometría, el material, la marca, los controles, las proporciones, la escala y el ángulo de cámara del producto. Cambia solo el entorno.
Para una persona:
Conserva la identidad facial, el peinado, la ropa, la pose, la posición corporal y el encuadre. Cambia solo el fondo y el ambiente de iluminación.
Da un papel a cada imagen de referencia
Al usar varias referencias, define la referencia A como sujeto y la referencia B como referencia de estilo o iluminación. Conserva después la estructura de A tomando de B ciertas características visuales.
Una distinción importante de nuestra investigación es que la capacidad multiimagen no garantiza la coherencia de personajes. Las imágenes relacionadas aún pueden variar en estructura facial, ropa, proporciones o detalles, por lo que las campañas secuenciales necesitan revisiones manuales de continuidad.
Los mejores usos de ChatGPT Image 2 en diseño profesional
ChatGPT Image 2 es más útil cuando una tarea requiere generación junto con composición estructurada, texto, edición y variaciones rápidas.
Uso | Valor principal | Prioridad de revisión |
Publicidad | Variantes creativas rápidas | Afirmaciones y coherencia de marca |
Ecommerce | Escenas de estilo de vida y campañas | Fidelidad del producto |
Packaging | Exploración rápida de conceptos | Texto y especificaciones |
Infografías | Texto y jerarquía visual | Precisión de datos |
Contenido social | Variaciones multiformato | Coherencia de marca |
Miniaturas | Pruebas rápidas de jerarquía | Legibilidad |
Visuales educativos | Explicación estructurada | Exactitud factual |
La publicidad y el ecommerce se benefician de las variaciones
La mayor ventaja de producción no es obtener antes una imagen final. Es poder explorar más hipótesis creativas: distintas composiciones, fondos, titulares, tratamientos estacionales, contextos de audiencia y relaciones de aspecto antes de decidir una dirección.
Para ecommerce, usa un flujo de producto de referencia → definición de escena → variación generada → revisión de fidelidad → refinamiento. Examina con cuidado costuras, materiales, botones, embalaje, proporciones y logotipos.
El mejor texto favorece al packaging y las infografías
La mejora en texto denso amplía la utilidad de los modelos de imagen con IA para packaging y diseño de información, pero las responsabilidades deben seguir claras: la IA puede generar el sistema visual; las personas deben verificar el sistema informativo.
Caso de ChatGPT Image 2: qué muestran realmente los datos de ROI
Un caso de MindStudio publicado por el proveedor sobre la marca D2C Luna & Sage ofrece uno de los conjuntos de datos más detallados de los materiales de investigación. Informa de estos cambios:
Métrica | Antes | Después, según el informe |
Coste anual de fotografía de producto | 42.000 dólares | 8.400 dólares |
Reducción de costes | — | 80% |
Plazo de entrega de imágenes | Unas 3 semanas | Unas 2 horas |
Biblioteca de imágenes | 200 | 2.000 |
Tiempo interno ahorrado | — | 20 horas/semana |
Tasa de conversión | 1,80% | 2,30% |
Tasa de devoluciones | — | Un 15% menor |
El ahorro fotográfico declarado es de 33.600 dólares al año, mientras que la biblioteca de recursos creció 10 veces. Más estratégicamente, pasar de unas tres semanas a dos horas cambia cuándo puede explorarse lo visual: los equipos pueden probar conceptos antes, sin esperar a que termine todo un ciclo de producción.

Sin embargo, el aumento de conversión del 1,8% al 2,3% y la reducción declarada del 15% en devoluciones no deben tratarse como benchmarks universales de GPT Image 2. El caso no aporta un estudio controlado independiente ni una metodología de atribución completa. La evidencia más sólida se refiere a coste de producción, velocidad y capacidad de contenido, mientras que el impacto comercial posterior requiere una medición aparte.

¿Qué es Images with Thinking?
Images with thinking añade razonamiento y uso de herramientas antes de generar imágenes. OpenAI afirma que puede planificar y refinar resultados, incorporar información de búsquedas web en directo y generar varias imágenes a partir de una petición.
Úsalo para diagramas basados en investigación, visuales educativos complejos, conceptos multiimagen o tareas cuya estructura factual deba planificarse antes de renderizar. Para cambiar un color o un fondo, la edición de imágenes normal suele bastar.
A fecha de agosto de 2026, OpenAI incluye ChatGPT Images 2.0 en todos los planes. Images with thinking está disponible actualmente en Plus, Pro y Business, con Enterprise y Edu anunciados como próximos. Para información sobre planes, consulta los precios de ChatGPT Image 2.
¿Cuáles son las principales limitaciones de ChatGPT Image 2?
Los materiales de investigación señalan varias áreas recurrentes que aún requieren revisión: textos largos, coherencia de personajes entre imágenes, manos, rostros, detalles finos y prompts abstractos.
El texto y la coherencia de personajes aún necesitan control de calidad
Los titulares y etiquetas cortos son cada vez más prácticos, pero las especificaciones largas, precios, avisos legales y textos de packaging deben comprobarse carácter por carácter.
Para personajes recurrentes, usa referencias sólidas y cambios pequeños, pero no supongas que la coherencia de personajes se mantendrá perfectamente estable durante una secuencia larga.
Las instrucciones visuales concretas son más controlables
«Muestra a un diseñador comparando tres conceptos de packaging sobre una mesa» define relaciones observables. «Visualiza la incertidumbre creativa» deja mucho más abierto a la interpretación.
En producción, describe qué debería verse, no solo qué sensación debería transmitir la imagen.
Cómo usar la API de GPT Image 2 a escala
OpenAI ofrece actualmente el modelo para desarrolladores gpt-image-2, con la versión fija gpt-image-2-2026-04-21. Admite generación y edición de imágenes, tamaños flexibles y entradas de imagen de alta fidelidad.
Elige tamaño y calidad según la etapa del flujo
GPT Image 2 admite resoluciones flexibles con un borde máximo de 3.840 píxeles, incluidas opciones populares como 1024×1024, 1536×1024, 1024×1536 y formatos 2K y 4K de mayor resolución. La calidad puede ser low, medium, high o auto. OpenAI recomienda low para borradores e iteraciones rápidas antes de pasar a medium o high para recursos finales.
Esto encaja naturalmente en un flujo de diseño con IA: exploración a baja calidad → dirección elegida → producción de mayor calidad → control humano.
Para automatizar, la API permite conectar datos estructurados de producto, sistemas de prompts reutilizables, nombres de recursos, generación, revisión y aprobación. Los límites oficiales actuales van de 5 IPM en Tier 1 a 250 IPM en Tier 5, lo que hace útil la API cuando la generación se convierte en infraestructura creativa y no en una tarea aislada.

Preguntas frecuentes
¿ChatGPT Image 2 es gratis?
ChatGPT Images 2.0 está disponible en todos los planes de ChatGPT, aunque los límites de uso pueden variar. Images with thinking tiene disponibilidad independiente y actualmente figura para Plus, Pro y Business.
¿Cómo evito que GPT Image 2 cambie mi producto?
Enumera explícitamente todo lo que debe permanecer fijo, como geometría, material, logotipo, controles, etiquetas, proporciones, ángulo de cámara y escala, y describe solo el cambio solicitado. Un patrón fiable es «mantén X sin cambios; modifica solo Y».
¿Puede GPT Image 2 generar texto e infografías precisos?
Ha mejorado en texto denso y diseños complejos, haciendo más prácticos anuncios, etiquetas, diagramas, conceptos de packaging e infografías. Aun así, antes de publicar deben verificarse ortografía, números, datos, textos legales, precios y funcionamiento de códigos QR.
¿GPT Image 2 mantiene bien la coherencia de personajes?
Puede crear imágenes relacionadas y usar referencias visuales, pero la identidad persistente aún puede variar en una secuencia larga. Usa una referencia sólida, preserva explícitamente los rasgos distintivos, haz cambios iterativos pequeños y revisa la continuidad de toda la serie.
Conclusión
La mejor forma de usar ChatGPT Image 2 es crear un flujo creativo controlado en vez de perseguir el prompt perfecto: define formato y diseño, establece sujeto y texto, protege lo invariable, genera una primera versión estructural, refina una variable cada vez y valida los detalles críticos antes de publicar. El caso Luna & Sage sugiere que estos flujos pueden cambiar sustancialmente los costes de producción y la capacidad de contenido, pero sus afirmaciones de resultados comerciales deben distinguirse claramente de la evidencia independiente.
Para equipos profesionales, la mayor oportunidad consiste en combinar la velocidad de generación con IA con la dirección artística humana, conocimientos de marca, control de calidad y sistemas reutilizables, y plataformas como Virse llevan este modelo más lejos al mantener conectados contexto de diseño, colaboración y conocimiento creativo acumulado durante todo el flujo.
Más del blog de Virse
Flujo de trabajo

GPT Image 2.5 Noise and Oversharpening: Why Some Images Still Look AI-Generated
9 de octubre de 2026 by Yifan Zhao
Flujo de trabajo

GPT Image 2.5 Keeps Changing My Image: How to Use a "Keep List" for Reliable Edits
9 de octubre de 2026 by Yifan Zhao
Flujo de trabajo

GPT Image 2.5 Editing Drift: Why Images Get Blurry, Cropped or Worse After Multiple Edits
9 de octubre de 2026 by Yifan Zhao