Anthropic detecta un grupo en Yemen usando Claude para diseñar misiles guiados
La compañía describe en un informe cómo unos actores usaron Claude Code como sustituto de ingenieros de software para escribir el software de guiado de tres programas de armamento.
Anthropic ha publicado un informe en el que detalla un caso concreto de mal uso de sus modelos. Un grupo de actores con base en el norte de Yemen empleó Claude Code para escribir el software de guiado, navegación y control (GNC) de tres programas de armamento distintos. Según la compañía, no hay pruebas de que llegaran a desplegar un dispositivo operativo, aunque sí dispararon un cohete guiado en una prueba de campo que, por lo que cuentan, falló.
Tres programas y un equipo de instancias
Los programas descritos son un cohete guiado con ordenador de vuelo de gama telefónica y guiado en fase final, un misil balístico de varias etapas con un objetivo de alcance declarado por encima de los 2.000 km, y un conjunto de variantes denominado "R2000" que incluía una versión con vehículo de planeo hipersónico.
El detalle interesante para quien trabaja con estos modelos es cómo organizaron el trabajo. Los actores levantaron varias instancias de Claude a la vez y repartieron papeles como haría un jefe de equipo en una ingeniería pequeña: una instancia escribía código, otra investigaba y una tercera revisaba lo que producía la primera. Con Claude integraron un piloto automático de código abierto sobre un ordenador de vuelo de clase telefónica, escribieron el software de control y estimación de posición, ajustaron los parámetros, montaron una cadena de compilación de firmware y lanzaron una simulación de vuelo.
Las salvaguardas de Anthropic bloquearon buena parte de las peticiones, pero no todas. Los actores escondieron sus objetivos y el producto final al que iba destinado el software, y trocearon el trabajo entre varias sesiones para que ninguna revelara la intención completa. Es decir, no hubo un único jailbreak brillante: hubo fragmentación y persistencia.
Tras el fallo de la prueba de tiro, volvieron al modelo en cuestión de horas para averiguar por qué no había funcionado.
Por qué importa
El informe de Anthropic está disponible en PDF y conviene leerlo entero, porque el resumen que circula por redes se queda en la anécdota del misil. Lo relevante para quien opera modelos es la parte de evasión: sesiones separadas, roles asignados, peticiones con el contexto recortado. Ese patrón de uso no es exclusivo de un programa de armamento, y sirve igual para cualquier tarea que un filtro bloquearía si la viera completa.
La compañía no ha detallado qué porcentaje de peticiones pasó sus controles ni cómo piensa cerrar ese hueco. Tampoco ha publicado las trazas de las conversaciones, así que la descripción del caso es suya y no verificable por terceros. Lo que sí queda claro es que el coste de escribir software de guiado ha bajado lo suficiente como para que un equipo sin ingenieros de software dedicados lo intente, y que las defensas actuales se sortean troceando el problema.


