BookinglyTech News
Ciberseguridad

AgentGuard endurece la seguridad de los agentes de codificación

AgentGuard, un CI-gate open source que revisa configuraciones de agentes de codificación, lanza su versión 0.2.1 tras bloquear un ataque en su propio repositorio y hallar cinco repositorios públicos con configuraciones maliciosas.

1 min de lecturaDev.to0 vistas

AgentGuard es una herramienta de código abierto que actúa como puerta de control en CI para configuraciones de agentes de codificación. Analiza archivos como AGENTS.md, skills, hooks y servidores MCP en busca de instrucciones ocultas que un agente podría ejecutar. Su autor la ha sometido a una doble prueba: plantó 12 ataques en su propio repositorio y escaneó 30 repositorios públicos.

Los 12 ataques incluían una instrucción oculta en AGENTS.md, caracteres cero-ancho en una skill, un servidor MCP con suplantación de identidad, un hook que redirige contenido de red a una shell y una API key cometida. AgentGuard los identificó todos, sin falsos positivos, respaldado por 47 pruebas unitarias. El escáner usa reglas deterministas y no emplea un LLM en su ruta de análisis.

En el análisis de repositorios públicos, cinco presentaron hallazgos críticos. El más llamativo era un carácter invisible justo antes de un bloque bash en una especificación de agente, algo que podría ser accidental o deliberado.

El desarrollo del propio proyecto sirvió como demostración: GitHub bloqueó un push con un token falso, y AgentGuard bloqueó un pull request de su proyecto al añadir una regla que impide que un PR modifique el archivo .agentguard-ignore. La versión 0.2.1 introduce gates que fallan en modo seguro, protección frente a ignorados en PR, un servidor Pro más endurecido con límites y nuevas detecciones de secretos. El código está en el repositorio, y una demo pública muestra cómo un ataque plantado recibe una calificación E y el merge se bloquea.