BookinglyTech News
Inteligencia artificial

OpenAI lanza GPT-Images 2.5: dos modelos API, menor latencia y ediciones precisas

Flare prioriza velocidad; Sunburst, control quirúrgico en retoques. La API cobra por token, y el coste real varía según la calidad y el modelo elegido.

2 min de lecturaThe Decoder0 vistas

OpenAI ha publicado la versión 2.5 de sus modelos de generación de imágenes. La apuesta técnica se divide en dos variantes disponibles a través de la API: GPT-Image-2.5 Flare, optimizada para reducir la latencia hasta un 50% respecto a la versión 2.0, y GPT-Image-2.5 Sunburst, diseñada para tareas que requieren un control estricto sobre los elementos editados, sacrificando velocidad. Ambos comparten esquema de precios base de 8 dólares por millón de tokens de entrada y 30 dólares por millón de salida, aunque el coste final por imagen depende del nivel de calidad solicitado y de la complejidad del procesamiento interno.

Control granular y coste variable

El diferencial técnico de esta iteración reside en la preservación del contexto. Los modelos 2.5 están entrenados para modificar únicamente los elementos especificados en el prompt, manteniendo inalterados fondos y sujetos secundarios incluso tras múltiples iteraciones. Esto soluciona un problema crónico en flujos de trabajo de diseño donde un retoque menor solía alterar la composición global. En pruebas realizadas, Sunburst mantiene la consistencia visual en entornos complejos, mientras que la variante rápida tiende a alterar detalles no solicitados si el prompt no es lo suficientemente restrictivo.

Aunque las tarifas por token son fijas, OpenAI no ofrece un precio promedio por imagen. El coste fluctúa según la cantidad de tokens consumidos en la generación, que varía drásticamente entre los niveles de calidad. Se introducen dos nuevas escalas, "xhigh" y "max", por encima del anterior techo de "high". Una imagen de 1024x1024 en calidad "low" ronda los 0,006 dólares, similar a la versión anterior. Sin embargo, el nivel "max" asciende a aproximadamente 0,21 dólares, consumiendo alrededor de 7.024 tokens de salida. Esto implica que una generación de máxima calidad con 2.5 equivale financieramente a una de alta calidad con la versión 2.0, pero con resultados visuales superiores y mayor fidelidad en instrucciones complejas.

En la interfaz de usuario de ChatGPT, OpenAI no permite elegir explícitamente el modelo. La ruta parece depender del contexto: el modo "Work" utiliza preferentemente Sunburst para garantizar precisión en ediciones estructuradas, mientras que el modo "Chat" suele recurrir a Flare, salvo en configuraciones de nivel superior como "6 Pro". Para desarrolladores que integren estos servicios, la diferencia no es solo cosmética; implica decidir entre throughput elevado (Flare) o fiabilidad en pipelines de producción crítica (Sunburst), asumiendo que el cliente final asumirá la variabilidad de costes.

Adicionalmente, la plataforma incorpora "Sketch", una herramienta que permite utilizar dibujos manuales como plantillas visuales mediante el comando @Sketch, y un sistema de plantillas predefinidas para formatos estándar como logotipos o infografías. También habilita la anulación de comentarios directos sobre las imágenes para iterar rápidamente. La capacidad de compartir prompts exactos que generan variantes sobre una foto base sugiere una orientación clara hacia flujos de trabajo colaborativos y repetitivos, donde la consistencia del estado inicial es prioritaria sobre la generación creativa *ex novo".