BookinglyTech News
Inteligencia artificial

OpenAI amplía el acceso a Ultrafast API y prepara nuevas opciones de velocidad

Documentación interna muestra que la compañía está añadiendo un modo Ultrafast a la API y podría abrirlo a más clientes en el DevDay de este fin de semana.

2 min de lecturaITHome0 vistas

OpenAI ha empezado a publicar documentación sobre una nueva opción de velocidad para su Responses API Playground. Según un post de la cuenta @imjustnewatai en X, el panel ahora permite elegir entre tres niveles: Standard, Fast y Ultrafast. La última opción, que ya estaba disponible en modo preview con el modelo GPT‑5.6 Sol, promete hasta 750 tokens por segundo, una mejora de aproximadamente 14 veces respecto al modo estándar.

Hasta ahora, Ultrafast solo estaba habilitado para un grupo limitado de clientes. La aparición de los nuevos documentos sugiere que OpenAI planea ampliar su disponibilidad, posiblemente durante el DevDay programado para el 29 de septiembre. No hay confirmación oficial, pero la coincidencia de fechas y la inclusión de la opción en la UI indican una intención clara de abrir el modo a más usuarios.

El anuncio llega justo cuando OpenAI ha lanzado la serie GPT‑6, compuesta por los modelos GPT‑6 Sol y GPT‑6 Astra. Aún no está claro si ambos modelos admitirán Ultrafast desde el primer día; la documentación no lo especifica. Si la integración se confirma, los desarrolladores podrían beneficiarse de respuestas mucho más rápidas en aplicaciones que requieren latencia mínima, como asistentes conversacionales en tiempo real o sistemas de generación de código interactivo.

Para los equipos de infraestructura, el cambio implica evaluar la capacidad de sus entornos para manejar la mayor carga de tokens por segundo. El consumo de GPU/TPU y el ancho de banda de red pueden convertirse en cuellos de botella si se escalan muchas instancias en modo Ultrafast. Además, la facturación de OpenAI está vinculada al número de tokens procesados, por lo que los costos podrían incrementarse significativamente al activar este modo.

En resumen, la expansión de Ultrafast API parece estar en marcha y podría estar disponible para un público más amplio en los próximos días. Los responsables de arquitectura y de costos deberán monitorizar tanto el rendimiento como el gasto, mientras que los desarrolladores podrán experimentar con latencias reducidas en sus flujos de trabajo.

Queda pendiente la confirmación oficial durante el DevDay y la lista exacta de modelos compatibles.