OpenAI lanzó el martes ChatGPT Images 2.5, nueva versión de su modelo de generación de imágenes, con ediciones más precisas y hasta un 50% menos de latencia frente a Images 2.0, según la empresa.
La actualización ya está disponible para usuarios de ChatGPT, ChatGPT Work y Codex en escritorio, móvil y web, según OpenAI y The Verge.
Ediciones más precisas y consistentes
Según OpenAI, el nuevo modelo produce una iluminación más natural y texturas más detalladas, y conserva mejor los elementos de las fotos de referencia que sube el usuario. La empresa afirma que las ediciones también se mantienen más estables a lo largo de conversaciones con varios turnos: un cambio hecho antes permanece intacto cuando el usuario pide un ajuste nuevo después, sin degradar el resto de la imagen.
OpenAI dice además que el modelo mejoró en la comprensión de instrucciones visuales complejas, incluidos diseños más elaborados e imágenes con fondo transparente, y que sigue con mayor fidelidad estilos visuales específicos pedidos por el usuario.
Sketch: dibujar para generar una imagen
La principal novedad de producto es Sketch, una función que permite dibujar directamente dentro de ChatGPT y usar ese dibujo como referencia visual. Para activarla, el usuario escribe "@Sketch" en el chat, según OpenAI. The Verge probó la herramienta y contó que un garabato mal hecho de un gato, dibujado con el mouse, se convirtió en una foto realista tras sumar instrucciones de texto.
SiliconANGLE señala que Sketch funciona mejor con un lápiz digital, como el Apple Pencil, ya que dibujar con el dedo directamente en la pantalla suele ser menos preciso, aunque la herramienta acepta cualquier tipo de trazo, incluido uno hecho con el mouse.
La actualización también añade plantillas para formatos habituales como pósteres y fotos de producto —entre las opciones están "Poster" y "Merch", que el usuario personaliza con información, elementos de diseño y estilo antes de generar el resultado final—. También se suma la posibilidad de dejar comentarios directamente sobre partes de una imagen para pedir ajustes puntuales, y de compartir el prompt usado junto con la imagen generada, para que otra persona repita la creación con sus propias fotos y datos.
Lo que cambia para quienes desarrollan productos
Para quienes usan la API, la consistencia entre ediciones también resuelve un problema de producción: según OpenAI, la actualización permite modificar un solo elemento —un producto, el fondo o un texto— sin rehacer toda la pieza, manteniendo intacto el resto de la composición. La empresa menciona como beneficiados a equipos que necesitan mantener la identidad visual de una marca a lo largo de una serie de piezas creativas, conceptos de interfaz que conservan una jerarquía definida y materiales de presentación con estructura fija.
Dos modelos nuevos para desarrolladores
Para quienes usan la API, OpenAI abrió acceso a dos modelos: GPT-Image-2.5 Flare, presentado como la opción por defecto para la mayoría de aplicaciones, y GPT-Image-2.5 Sunburst, pensado para ediciones que exigen más precisión y aceptan tiempos de generación más largos, según la empresa y SiliconANGLE.
OpenAI afirma que Images 2.5 mantiene las mismas capas de seguridad usadas en versiones anteriores, con verificación de prompts e imágenes, metadatos C2PA y una marca de agua invisible para identificar contenido generado con la herramienta.
En el anuncio, OpenAI menciona a equipos de creación, marketing, retail y medios entre los públicos que ya construyen flujos de trabajo con su API de imágenes — el sector que probablemente note primero el cambio, ya que los dos modelos nuevos se integran directamente en esos procesos. La empresa dice que la suma de ChatGPT Images y los modelos GPT-Image de la API supera los 3.000 millones de imágenes generadas por semana.
Images 2.5 sucede a Images 2.0, lanzado en abril, según SiliconANGLE.


