OpenAI presentó ChatGPT Imágenes 2.5, una nueva versión de su modelo de generación y edición visual que mejora la conservación de sujetos tomados desde imágenes de referencia, la iluminación, las texturas y el seguimiento de instrucciones. La compañía asegura que también redujo la latencia de generación hasta en un 50% frente a Imágenes 2.0.
El modelo apunta especialmente a mejorar las ediciones específicas. Según OpenAI, Imágenes 2.5 puede modificar un producto, fondo o fragmento de texto manteniendo sin cambios el sujeto, la composición y el estilo del resto de la imagen. También mejora la coherencia durante varias ediciones consecutivas para conservar los cambios realizados previamente.

Sketch y nuevas herramientas para crear imágenes
ChatGPT incorpora además Sketch, una función que permite dibujar directamente dentro de la plataforma y utilizar ese boceto como referencia visual para generar una imagen. OpenAI también añadió plantillas para formatos como pósteres y productos promocionales, junto con la posibilidad de agregar comentarios directamente sobre una imagen para indicar los cambios requeridos.
Otra función permite compartir una imagen junto con el prompt utilizado para crearla, de modo que otras personas puedan reutilizar la idea con sus propias imágenes y detalles. ChatGPT Imágenes 2.5 ya está disponible para usuarios de ChatGPT, ChatGPT Work y Codex en computadoras, dispositivos móviles y la web.

Para desarrolladores, OpenAI lanzó GPT-Image-2.5 Flare y GPT-Image-2.5 Sunburst mediante la API. Flare es la opción predeterminada para la mayoría de las aplicaciones y, según la compañía, ofrece mayor calidad que GPT-Image-2 con un 50% menos de latencia. Sunburst está orientado a flujos visuales que requieren mayor precisión entre sucesivas ediciones.
OpenAI mantiene además verificaciones de prompts e imágenes como parte de sus medidas de seguridad e incorpora metadatos C2PA y marcas de agua invisibles para facilitar la identificación de imágenes creadas mediante sus herramientas.

