Anthropic documenta ocho meses de abuso de Claude: APT rusos, extorsión y armas biológicas
La compañía publica un informe con los casos en los que su modelo sirvió para hackeos patrocinados por Estados, campañas de desinformación y desarrollo de patógenos

Anthropic ha publicado un informe que repasa cómo se ha abusado de Claude durante los últimos ocho meses, y el catálogo da vértigo: intrusiones patrocinadas por Estados, campañas de desinformación, extorsión y, en unos cuantos casos, intentos de desarrollar armas biológicas. La compañía afirma que interrumpió todas esas actividades mientras estaban en marcha.
El caso más llamativo es el de Midnight Blizzard, el grupo que Microsoft atribuye a Rusia. Según el informe, lo usó para tareas de reconocimiento contra redes de gobiernos ucranianos y europeos, y de ahí pasó a robar datos y a mantenerse dentro. El grupo criminal ShinyHunters lo empleó en prácticamente todas las fases de sus campañas de hackeo y extorsión. También hubo operaciones de influencia en países que van de Kenia a Bangladesh, y un puñado de usuarios que parecían estar intentando desarrollar patógenos y toxinas.
El documento está planteado como un balance de éxitos en la contención de amenazas, pero se lee más incómodo que tranquilizador. No hay garantía de que Anthropic haya detectado todos los usos maliciosos de su herramienta, y eso contando solo con Anthropic: los competidores y los modelos abiertos, con menos controles, no publican nada parecido. El informe está disponible en el blog de Anthropic.
El mayor mercado negro del mundo, intervenido
Xinbi Guarantee llevaba cuatro años funcionando y se había convertido en el mayor mercado ilícito de internet, con más de 30.000 millones de dólares en ventas, en su mayoría blanqueo para estafas de inversión en criptomonedas con base en el sudeste asiático. También ofrecía trata de personas y acoso por encargo. Todo dependía de Telegram, que cerró Xinbi hace un año y no impidió que volviera a levantarse, más grande que antes. Esta semana el gobierno estadounidense ha requisado sus canales en la plataforma y ha sancionado el mercado. El Departamento de Justicia ha anunciado además redadas en 13 complejos de estafa en Madagascar.
En paralelo, un miembro del grupo de ransomware Conti ha sido condenado a cuatro años de prisión. La banda, disuelta oficialmente en 2022, atacó a más de mil víctimas según las autoridades estadounidenses.
Y en el terreno de la privacidad, una investigación ha documentado que Meta no detectó unos 350 anuncios de abuso infantil generados con IA, algunos con imágenes de menores reales. La fiscalía de San Francisco le ha ordenado esta semana que deje de permitirlos.
Lo relevante del informe de Anthropic no es la lista de incidentes, sino el patrón: el abuso del modelo ya no es cosa de un actor sofisticado en un caso aislado, sino de grupos que lo meten en cada fase de su operación. Para quien lleva la seguridad de una organización, eso significa que la huella de la IA en un incidente deja de ser un correo de phishing bien escrito y pasa a estar en el reconocimiento, la explotación y la negociación del rescate. Ninguna de las tres cosas se detecta con las reglas de siempre.


