BookinglyTech News
Inteligencia artificial

OpenAI alerta a la carrera por la invisibilidad de la cadena de razonamiento en Astra

El modelo Astra de OpenAI ha sido señalado por no exponer su razonamiento en texto, lo que genera debate sobre su monitorabilidad y la necesidad de reportes obligatorios según la normativa europea.

2 min de lecturaThe Next Web0 vistas

OpenAI ha declarado que su nuevo modelo, Astra, no expone en texto todo el proceso de razonamiento que sigue para resolver problemas complejos, lo que plantea interrogantes sobre la posibilidad de observar y evaluar su funcionamiento interno.

El investigador de seguridad IA Ryan Greenblatt, de Redwood Research, publicó en X que Astra parece resolver problemas de matemáticas competitivas “completamente en su cabeza”, una característica que considera “extremadamente preocupante”. La falta de trazabilidad de la cadena de pensamiento dificulta la identificación de sesgos o fallos internos.

En respuesta, el científico jefe de OpenAI, Jakub Pachocki, subrayó la importancia de evitar una carrera hacia la “inmonitorabilidad” y anunció planes de publicar más análisis sobre el tema. Pachocki fue coautor de un documento de posición de 2025 que abogó por la monitorabilidad de la cadena de pensamiento como una oportunidad crítica para la seguridad de la IA.

El documento, firmado por investigadores de OpenAI, Google DeepMind, Anthropic, Meta, Amazon, el UK AI Security Institute y Redwood Research, pide a los desarrolladores construir evaluaciones estandarizadas de monitorabilidad, incluir los resultados, la metodología y las limitaciones en los “system cards” y equilibrar la monitorabilidad con la capacidad del modelo al decidir si entrenar o desplegar.

En Europa, la normativa del GPAI Code of Practice obliga a los signatarios a presentar un “Model Report” al AI Office antes de lanzar un modelo. El informe debe incluir evaluaciones, mitigaciones y, de manera obligatoria, cinco muestras aleatorias de entradas y salidas de cada evaluación relevante, de modo que terceros puedan comprobar de forma independiente el trabajo del modelo.

OpenAI ya ha incorporado un coste de 20 % de cómputo para supervisar sus propios sistemas, pero no ha confirmado si Astra ha sido diseñado con intenciones de limitar la visibilidad de su razonamiento.

Este debate se vuelve aún más interesante porque los mismos autores que redactaron el documento de 2025 también participaron en la discusión sobre Astra, mostrando un consenso inicial sobre la necesidad de una mayor transparencia.

Para los responsables de infraestructura y seguridad, la cuestión plantea preguntas prácticas: ¿cómo se deben adaptar los pipelines de CI/CD para incluir pruebas de monitorabilidad? ¿Qué implicaciones tiene la obligación de reportar muestras de entrada y salida para la arquitectura de datos? Y, sobre todo, ¿cómo equilibrar la competitividad de los modelos con la responsabilidad normativa?