BookinglyTech News
Inteligencia artificial

Reconstruyen 278 prompts detrás de las imágenes de ejemplo de GPT Image 2.5

OpenAI mostró ejemplos del modelo sin publicar las instrucciones que los generaron. Un usuario las ha deducido a partir de los resultados y las ha reunido en un repositorio.

2 min de lecturar/PromptEngineering0 vistas

OpenAI acompañó el anuncio de GPT Image 2.5 con una batería de imágenes de ejemplo, pero no publicó los prompts que las habían producido. Un usuario ha hecho el camino inverso: partir de los resultados, deducir las instrucciones y juntar 278 de ellas en un repositorio ordenado por tipo de tarea.

La colección se divide en cuatro bloques: fidelidad a una referencia, edición de precisión, estilo, y composición y tipografía complejas. El autor avisa de que son reconstrucciones, no los prompts oficiales de la compañía, así que se acercan al resultado sin ser idénticos al original. Acepta pull requests de quien consiga una versión más fiel, y todo el material se ha probado contra gpt-image-2.5.

Lo que se repite en los prompts que aguantan

Al reconstruirlos, el autor se encontró con varios patrones que aparecen una y otra vez.

El primero tiene que ver con adjuntar una imagen de referencia. Pegar una foto y decir "usa esto" devuelve una atmósfera, nada más. Las instrucciones que consiguen mantener una identidad concreta explicitan qué controla esa referencia y cuáles de sus rasgos tienen que sobrevivir en el fotograma nuevo.

El segundo afecta a la edición. Funciona mejor escribirla como dos cláusulas en un orden fijo: primero lo único que hay que cambiar, después la lista de lo que no puede moverse. Esa segunda parte suele ser más larga de lo que la gente espera.

Sobre las restricciones, el autor es tajante: solo sirven si sostienen algo. Los prompts buenos nombran dos o tres exclusiones que importan de verdad. Las listas largas de cosas prohibidas producen salidas planas y literales.

Y para el estilo, la descripción óptica concreta gana a los adjetivos. Cámara de película antigua, luz de estudio suave, grano sutil, paleta cálida. "Cinemático" por sí solo no hace nada. Uno de los ejemplos del bloque de fidelidad a referencia lo ilustra: un retrato de estudio de los años 80 con un hombre sonriente, chaqueta cortavientos de nailon retro en turquesa, magenta y azul, fondo con láser rosa y azul, una palmera desenfocada y un radiocasete, todo descrito junto al tipo de cámara, la luz y la paleta.

Los prompts son explícitos y verificables solo hasta cierto punto: nadie fuera del autor ha comprobado que reproduzcan las imágenes originales al pie de la letra. Lo que sí se puede contrastar es el catálogo, que está abierto y se puede ejecutar.

Para quien trabaja con modelos de imagen, el interés no está tanto en las 278 entradas como en la estructura que se repite detrás de ellas. Es la diferencia entre copiar un resultado y entender por qué salió. Queda por ver si OpenAI publica alguna vez los prompts oficiales y hasta qué punto coinciden con estas reconstrucciones.