BookinglyTech News
Inteligencia artificial

OpenAI amplía acceso a evaluadores externos para pruebas de IA frontier

OpenAI formaliza un programa que permite a organizaciones externas acceder a checkpoints tempranos y trazas de razonamiento de modelos como GPT‑5 para evaluar riesgos de seguridad.

2 min de lecturaDev.to0 vistas

OpenAI ha anunciado la ampliación de su programa de evaluaciones externas para IA frontier. No se trata de un nuevo producto o API, sino de un modelo de pruebas de seguridad más estructurado que brinda a entidades calificadas un acceso más profundo a los modelos en fases de entrenamiento, evaluación y despliegue.

El proceso se divide en tres tipos de colaboración: evaluaciones independientes de capacidades y riesgos, revisiones metodológicas de los enfoques de pruebas y pruebas especializadas por expertos en áreas de riesgo concreto. Cada forma implica un rol distinto para el evaluador externo, desde ejecutar pruebas de capacidad hasta auditar la metodología de seguridad y aplicar conocimiento de dominio para detectar vulnerabilidades específicas.

Para la era de GPT‑5, OpenAI ha coordinado evaluaciones que cubren autonomía a largo plazo, planificación de engaños, subversión de supervisión, factibilidad de experimentos en laboratorio y uso ofensivo en ciberseguridad. Los evaluadores pueden recibir acceso seguro a checkpoints tempranos y resultados de evaluaciones selectivos, con la posibilidad de trabajar bajo condiciones de retención cero de datos y con mitigaciones reducidas. En algunos casos también se les permite inspeccionar trazas de razonamiento ("chain‑of‑thought") bajo estrictos controles.

OpenAI subraya que los resultados de estas pruebas se publicarán parcialmente, mediante tarjetas de sistema y reportes revisados por confidencialidad y precisión. Ya se citan ejemplos de informes de METR, Apollo Research e Irregular sobre GPT‑5.

Para los equipos que integran modelos de OpenAI mediante API, el programa no elimina la necesidad de validar el comportamiento del modelo dentro de flujos de trabajo específicos. Se recomienda leer las divulgaciones de evaluación junto a la documentación del producto, mantener revisiones humanas en procesos críticos y probar el flujo completo, no solo el modelo aislado.

Aunque la iniciativa no implica cambios en precios ni en la disponibilidad de la API, la mayor transparencia podría proporcionar a los responsables de decisiones técnicas información más rica para seleccionar modelos y diseñar salvaguardas adecuadas.

En resumen, OpenAI está institucionalizando el acceso externo a sus modelos frontier, lo que podría convertirse en un componente habitual del ecosistema de seguridad de IA y ofrecer a las organizaciones una visión más clara de los riesgos asociados a los modelos de última generación.