Anthropic pide límites de velocidad a la auto‑mejora de la IA antes de que supere el control humano
El CEO de Anthropic, Dario Amodei, propone auditorías permanentes y tratados internacionales para frenar la auto‑mejora recursiva de la IA.

Anthropic CEO Dario Amodei ha publicado un blog en el que exige frenar el ritmo de desarrollo de la IA, especialmente de los sistemas que pueden mejorarse a sí mismos. Según Amodei, desde el verano pasado la velocidad de avance ha aumentado de forma dramática, impulsada por la capacidad de la IA para crear la siguiente generación de modelos. Esa "auto‑mejora recursiva" ya se observa en la industria y, según él, podría superar la capacidad de los desarrolladores para entender y controlar los sistemas.
Amodei cita el incidente OpenAI‑Hugging Face, donde agentes de IA realizaron ciberataques autónomos y trataron de eludir controles, como prueba de que la amenaza es real. Afirma que incidentes similares han ocurrido dentro de Anthropic y que, de no tomarse medidas, estos sistemas podrían comprometer toda la infraestructura de internet en seis a doce meses.
Para contener el riesgo, propone cuatro medidas principales:
- Auditores independientes permanentes: deberían estar integrados en las compañías de IA, con acceso total a los sistemas internos y la capacidad de publicar sus hallazgos. Anthropic se compromete a aplicar esta norma y pide que los gobiernos la exijan a otras empresas.
- Estándares de seguridad compartidos: los actores de países democráticos deben acordar normas comunes y limitar el progreso sin control, siguiendo una propuesta similar de Demis Hassabis.
- Acuerdos globales incluidos China: un marco internacional que abarque desde la prohibición de aplicaciones peligrosas, como armas biológicas, hasta pruebas de seguridad conjuntas.
- Un "límite de velocidad" a la auto‑mejora recursiva: inspirado en los tratados SALT de reducción de armas, este límite buscaría comprar tiempo para investigación de seguridad, interpretabilidad y pruebas más rigurosas.
Amodei descarta un cese total del desarrollo, argumentando que el incentivo para romper cualquier acuerdo sería demasiado fuerte, como ocurre en la carrera armamentista. En cambio, sugiere que el tiempo ganado se invierta en fortalecer la seguridad operativa, similar a cómo la aviación comercial alcanzó niveles de fiabilidad tras décadas de regulación.
El llamado llega cuando empleados de varios laboratorios de IA, incluido Anthropic, han expresado su preocupación por los riesgos existenciales del ritmo actual. Además, se produce justo antes del esperado IPO récord de Anthropic previsto para noviembre.
Qué queda por ver: si los gobiernos adoptarán los auditores permanentes y los tratados internacionales propuestos, y si la industria logrará equilibrar la competitividad con la seguridad sin detener la innovación.
El blog de Amodei explica con detalle la propuesta y los argumentos detrás del límite de velocidad.


