OpenAI lanza GPT-Image-2.5 con modelos Sunburst y Flare para API
La nueva versión prioriza la precisión en ediciones y la velocidad, con mejoras en la coherencia de los sujetos a lo largo de varias interacciones.
OpenAI ha desplegado la versión 2.5 de sus modelos de generación de imágenes, disponibles tanto en ChatGPT como a través de la API. El anuncio coincide con una cifra de uso propia de la compañía que sitúa el volumen de imágenes procesadas "en más de 3.000 millones de imágenes a través de ChatGPT Images y los modelos GPT-Image en la API".
La principal novedad técnica radica en la mejora de la capacidad de seguir instrucciones a lo largo de múltiples turnos de conversación. El sistema responde más rápido y, según OpenAI, es superior en la preservación de los sujetos presentes en las fotos de referencia. Esto es relevante para flujos de trabajo donde se requiere editar imágenes manteniendo la identidad visual de un elemento concreto a través de varios prompts.
En la API, la actualización introduce dos identificadores de modelo nuevos: gpt-image-2.5-sunburst y gpt-image-2.5-flare. Simon Willison, autor de la nota original, analiza la diferenciación entre ambos: Sunburst está orientado a flujos donde la precisión en la edición es crítica, mientras que Flare se posiciona para la generación diaria rápida de alta calidad. Esta segmentación sugiere que los arquitectos de software que integran estos modelos pueden necesitar seleccionar el endpoint adecuado según el caso de uso: latencia mínima o fidelidad de edición.
Willison ha actualizado su herramienta de línea de comandos openai_image.py para soportar la entrada de una o varias imágenes de referencia. El comando permite pasar una imagen base y un prompt de texto para generar una nueva iteración. Por ejemplo, al pasar una imagen de un gráfico y pedir "añadir una comadreja científica estudiando el gráfico", el modelo generó una imagen que incorpora el nuevo elemento manteniendo el contexto original. El código de la herramienta está disponible en GitHub.
La documentación oficial en developers.openai.com detalla los parámetros y los nuevos IDs. Para quien integra generación de imágenes en productos, la disponibilidad de dos variantes en la misma versión permite hacer pruebas A/B sobre coste y calidad sin cambiar de proveedor. No hay información sobre cambios en la facturación por token o por imagen, aunque la mejora en velocidad podría traducirse en menores tiempos de espera en的生产 entornos de usuario final.


