OpenAI lanza ChatGPT Images 2.5 con la herramienta Sketch para generar imágenes desde garabatos
La nueva versión mejora la latencia hasta un 50% y permite editar zonas específicas de las imágenes mediante comentarios directos.

OpenAI ha actualizado su motor de generación de imágenes a la versión 2.5, incorporando una funcionalidad denominada Sketch. Esta herramienta permite a los usuarios crear imágenes a partir de bocetos rudimentarios dibujados directamente en la interfaz de ChatGPT, eliminando la necesidad de descripciones textuales extensas para definir la composición inicial.
Cómo funciona Sketch
El flujo de trabajo es directo: se escribe "@Sketch" en la caja de diálogo para abrir un lienzo donde realizar el dibujo. Una vez completado el garabato, el usuario proporciona instrucciones sobre cómo convertirlo en una imagen final. OpenAI confirma que el sistema es capaz de interpretar trazos sencillos, como un gato dibujado con ratón, y transformarlos en fotografías realistas siguiendo las directrices de estilo solicitadas. La función está disponible inmediatamente para usuarios de ChatGPT, ChatGPT Work y Codex en plataformas de escritorio, móvil y web. En la ficha oficial del lanzamiento, OpenAI detalla las capacidades técnicas y los casos de uso previstos para esta nueva iteración.
Mejoras técnicas y edición
Más allá de la entrada por dibujo, la versión 2.5 introduce mejoras en la precisión del modelo. La compañía señala que las nuevas imágenes presentan una iluminación más natural y texturas más ricas. Un cambio relevante para flujos de trabajo iterativos es la capacidad de mantener coherencia en las instrucciones de edición a lo largo de múltiples turnos de conversación. Esto facilita el refinamiento progresivo de una imagen sin que el modelo "olvide" parámetros definidos anteriormente.
También se ha implementado un sistema de anotación directa: los usuarios pueden dejar comentarios sobre partes específicas de la imagen generada para solicitar cambios puntuales. Por ejemplo, es posible indicar que los ojos de un personaje deben ser verdes en lugar de azules, y el modelo aplicará esa modificación localizada sin alterar el resto de la composición. OpenAI afirma que la latencia de generación se ha reducido hasta en un 50% en comparación con Images 2.0, un dato que impacta positivamente en la experiencia de usuario para tareas que requieren varios ajustes secuenciales. Aunque la cifra de reducción de latencia proviene de la propia empresa, la mejora en la coherencia contextual y la edición localizada son características que resuelven limitaciones frecuentes en versiones anteriores de modelos de difusión o transformadores visuales.


