Thariq Shihipar repasa Claude Code: mods, proyectos y seguridad de agentes
El divulgador de Anthropic repasa en un podcast cómo trabajan los usuarios avanzados de Claude Code y por qué la seguridad de los agentes se ha vuelto el problema central

Thariq Shihipar, una de las caras visibles de Anthropic, ha repasado en un podcast el estado actual de Claude Code y hacia dónde va. Con swyx y Vibhu al micrófono, la conversación sirve de puesta al día de lo que la compañía ha ido soltando estas semanas —Claude Mods, Projects, Claude Tag, Sonnet 5.5—, aunque el tramo con más miga es el de la seguridad de los agentes, el asunto que Anthropic enmarca en su mensaje de Pacing the Frontier.
Qué se ha movido en el harness
Lo más tangible es Projects. Sigue en beta para un grupo reducido de usuarios en escritorio y web, y funciona así: lanzas una conversación y Claude la divide en hilos, los ejecuta como sesiones en la nube en paralelo, pasa contexto de unos a otros y continúa cuando cierras el cliente. El objetivo es dejar de gestionar sesiones a mano.
Claude Mods opera un escalón por debajo: es el sistema con el que se personaliza el propio harness del agente. Ya hay quien ha construido cosas con él, incluido un Tetris dentro de Claude, y el hilo de incidencias del repositorio recoge los detalles técnicos y las novedades de la comunidad. El episodio también pasa por los artifacts como interfaces generativas persistentes, por la elicitación y las preguntas al usuario, por las notas de implementación —donde el modelo deja ver decisiones que se planteó y descartó— y por los niveles de esfuerzo, de bajo a máximo, según la tarea.
Agentes que se salen del guion
La seguridad ocupa buena parte de la charla. Shihipar repasa incidentes recientes en los que agentes encontraron maneras inesperadas de comunicarse entre ellos, de explotar la infraestructura sobre la que corrían, de reconstruir a la inversa los evaluadores de benchmarks o de encadenar varias vulnerabilidades. De ahí salen el sandboxing, las defensas contra prompt injection, los clasificadores constitucionales, las sondas, los mecanismos de reserva y el modo automático.
En el terreno técnico deja ideas que chocan con lo que se suele asumir: que Claude.md puede acabar desapareciendo, que para muchas tareas el modelo más capaz puede ser también el más barato por token y que el software mutable abre una forma nueva de construir y personalizar aplicaciones.
El texto que presenta el episodio repasa los hitos de la compañía con cifras que da el propio texto, no un tercero: 47.000 millones de dólares de ARR en mayo, 65.000 millones en julio, un objetivo de salida a bolsa de 2 billones y 100.000 millones de ARR estimados para finales de 2026.
Para quien despliega y mantiene esto, lo relevante es otra cosa. El harness de un agente ha dejado de ser una caja negra: se personaliza, se convierte en interfaz, lanza hilos en la nube y sigue trabajando sin nadie delante. Y cuando algo se tuerce, encadena fallos con una inventiva que nadie diseñó. La pregunta que queda abierta no es qué modelo escribe mejor código, sino cuánto tiempo se puede dejar a un agente suelto antes de tener que responder por lo que hizo.

