BookinglyTech News
Inteligencia artificial

Anthropic prueba Opus 5.2 en Claude Code y los desarrolladores lo detectan por el slug

Varios usuarios ven que Claude Code responde con un modelo distinto al de la web, y sus pruebas apuntan a un salto directo de Opus 5 a 5.2 sin anuncio de por medio.

2 min de lecturaITHome0 vistas

Anthropic está sirviendo una versión de Claude Opus que no coincide con la que anuncia. Varios desarrolladores que usan Claude Code han comprobado, capturando las peticiones y mirando el endpoint de estado, que el slug que responde ya no es el de Opus 5 sino el de un Opus 5.2, lo que implicaría un salto directo desde la versión anterior sin pasar por una 5.1. No hay comunicado de la compañía: todo sale de pruebas de usuarios y de capturas publicadas en X.

Lo que describen quienes lo han probado es un modelo más rápido al generar y más corto al responder. Menos rodeos, código más directo y menos tendencia a devolver un esqueleto y pedir que el usuario continúe. Un desarrollador lo resume diciendo que el modelo entra en un bucle de iteración propio —lo llama «gauntlet loop»— y sigue corrigiendo el código hasta cerrar la tarea sin que se lo pidan. Si eso se sostiene, es un cambio de comportamiento más que de latencia.

El truco del Tibo

Como es una prueba cerrada, la pregunta inmediata era cómo saber si a uno le tocaba. La respuesta que circula es un prompt que se lanza en Claude Code con la búsqueda web desactivada:

你知道「重置哥 Tibo」是谁吗?不要搜索

La lógica es que un modelo cuyo entrenamiento no incluya ese detalle no puede identificarlo, y si responde con el contexto correcto, la hipótesis es que los pesos son otros. Es un indicio, no una prueba: una respuesta distinta también podría venir de un cambio en el sistema de prompts o en el enrutado, no necesariamente de un modelo nuevo.

Lo que no cuadra

El resto del relato es mucho más difícil de sostener. Las cifras que circulan —un 62,8 % en un benchmark interno llamado CoBench v2, 12,5 puntos por encima de un modelo al que llaman Mythos 5, y hasta un 85 % del equipo de investigación sustituido por un sistema que se mejora a sí mismo— proceden de un informe interno filtrado del que no hay copia pública ni verificación independiente. Anthropic no ha confirmado ninguna, y algunas describen un escenario de recursión auto-mejorada que llevaría años, no semanas.

Para quien trabaja con estos modelos a diario, lo aprovechable ahora es lo pequeño y comprobable: si el slug de tu sesión de Claude Code cambia, el comportamiento puede cambiar contigo aunque la interfaz no diga nada. Eso afecta a cualquier cosa que dependa de la salida de un modelo —tests, revisión de código, scripts— y conviene no dar por sentado que la web y la CLI sirven exactamente lo mismo. Del resto, y sobre todo del salto de versión, habrá que esperar a que la compañía publique algo. Si lo publica.