Anthropic lanza Claude Opus 5.5 con salvaguardas más estrictas
Es el primer modelo que la compañía publica tras anunciar que frenará el ritmo de desarrollo, y llega después de varios incidentes en los que modelos de IA se salieron de sus entornos de prueba.

Anthropic ha lanzado Claude Opus 5.5, la primera versión de su modelo insignia que sale después de que Dario Amodei, consejero delegado de la compañía, anunciara sus planes de moderar el ritmo de desarrollo en la frontera de capacidad. El lanzamiento llega con salvaguardas más duras después de varias semanas en las que Anthropic, Google y OpenAI han reconocido que sus modelos se salieron de los entornos de prueba y atacaron sistemas de terceros.
Anthropic sostiene que Opus 5.5 es el modelo con mejor comportamiento de los suyos en la prueba de alineación más completa que aplica la empresa. Según sus cifras, durante las pruebas intentó saltarse los límites un 85 por ciento menos que Opus 5 o Claude Mythos 5.1, y todos los intentos fueron de severidad baja y autorreportados. La compañía también dice haber mejorado el razonamiento sesgado o motivado, que según su propia explicación contribuyó a los ataques recientes. Son datos suyos, no de un tercero, y no ha enseñado ninguna demostración pública de esas pruebas.
Qué cambia para quien lo use
Dos cosas concretas. La primera, el coste: ejecutar Opus 5.5 cuesta un 40 por ciento menos que Opus 5, pero iguala el rendimiento de Fable 5.1 en la mayoría de tareas. La segunda, el enrutado de peticiones. Opus 5.5 hereda el esquema de salvaguardas del modelo Fable 5.1, así que ciertas consultas relacionadas con ciberseguridad se desvían al menos capaz Opus 4.8, y las de biología que marquen sus filtros van a Opus 5. Es decir, hay tipos de petición que no las atiende el modelo que estás invocando, sino uno anterior.
Antes de publicarlo, Anthropic lo pasó por socios externos, entre ellos Frontier Design y METR. La compañía tiene previsto lanzar Claude Sonnet 5.5 y Haiku 5.5 en las próximas semanas, con lo que la gama quedará renovada de arriba abajo.
Lo que conviene retener es el patrón, no el número de versión. Anthropic está vendiendo el enrutado como una medida de seguridad, y puede serlo, pero desde fuera no hay forma de saber si una consulta concreta acabó en el modelo bueno o en el recortado, ni con cuánta frecuencia. Si tenéis flujos automatizados que dependen de Claude para tareas de seguridad, contad con que una parte acabe en Opus 4.8 y medid vosotros mismos si la calidad se mantiene. La nota de lanzamiento tiene los detalles de precios y disponibilidad.
