Anthropic publica informe sobre bloqueos a usos biológicos de Claude
La empresa reveló tres casos en China, dos en Rusia y uno en Yemen donde su modelo Claude fue usado para intentar diseñar armas biológicas o convencionales.

Anthropic ha publicado un informe que detalla ocho incidentes en los que su modelo de lenguaje Claude fue empleado para investigaciones que podrían facilitar la creación de armas biológicas. La compañía afirma que, ante la ambigüedad entre investigación legítima –como el desarrollo de vacunas– y usos peligrosos, optó por bloquear los casos para evitar posibles daños.
El reporte, disponible en el sitio de la empresa, enumera tres intentos detectados en China, dos en Rusia y uno en Yemen, este último vinculado al grupo Houthi respaldado por Irán. En cada caso, los investigadores intentaron generar código o protocolos que podrían acelerar la ingeniería de patógenos o la fabricación de armas convencionales, como misiles y drones.
Andrew Weber, senior fellow del Council on Strategic Risks, calificó los hallazgos como "ejemplos escalofriantes" de actores estatales que explotan la IA de última generación. El informe también menciona usos de Claude para campañas de desinformación en medios rusos y para vigilancia de comunidades disidentes vinculadas a gobiernos chinos e iraníes, aunque esos episodios no son el foco principal del documento.
Anthropic señala que, en varios de los casos, no pudo confirmar si la investigación tenía un propósito legítimo o malintencionado porque la frontera entre la biología básica y la biotecnología de armas es difusa. Sin embargo, la empresa decidió actuar de forma preventiva, bloqueando el acceso a Claude y notificando a las autoridades correspondientes.
El New York Times cubrió la historia, subrayando la creciente preocupación en la comunidad de seguridad sobre el potencial de los grandes modelos de IA para acelerar la creación de patógenos desconocidos. El artículo también menciona que incluso los propios diseñadores de IA dudan de su capacidad para controlar completamente estos riesgos.
Para los equipos de seguridad y los responsables de cumplimiento, el informe de Anthropic sirve como una señal de alerta: la vigilancia de los usos internos de los modelos de IA debe ser tan rigurosa como la monitorización externa. Implementar controles de uso, auditorías de prompts y mecanismos de detección de patrones de generación de código peligrosos será clave para limitar futuros abusos.
Queda por ver cómo otras compañías de IA responderán ante esta amenaza y si se establecerán estándares de la industria para la detección y mitigación de usos biotecnológicos de modelos de lenguaje.


