AWS publica Strands, un harness de agentes open source que gasta menos tokens
AWS publica un harness de agentes open source que, según sus propias pruebas, iguala a Claude Code y Codex en benchmarks con un 28 % menos de tokens.
Amazon Web Services ha publicado Strands, un harness de agentes de código abierto que viene empaquetado y listo para funcionar, ya sea en local o desplegado contra el proveedor de modelos que prefiera el cliente. La compañía dice que iguala en puntuación a Claude Code, Codex y otros harnesses populares mientras consume alrededor de una cuarta parte menos de tokens. Se distribuye como librería de Python y de TypeScript, y también tiene CLI.
El harness se apoya en el SDK Strands de AWS, pero aquí llega montado. Según el anuncio, basta una línea de Python o TypeScript para conectarlo al modelo que se elija. Trae de serie herramientas de shell, ficheros y web, además de un fichero de skills para enchufar las propias sin demasiada ceremonia.
De dónde salen los números
Las cifras son de AWS, y la evaluación también. Las pruebas se hicieron con el framework Harbor, repartidas entre varias instancias EC2 de la propia Amazon. Strands consumió un 28 % menos de tokens que los modelos Claude o GPT en seis benchmarks, y en algún caso también acertó más que otros harnesses. El harness de DeepSeek resultó más eficiente en tokens, admite la compañía, pero menos preciso en esas mismas pruebas.
AWS atribuye el resultado a los valores por defecto de caché de prompt y gestión de contexto: trunca los resultados de herramientas que pasan de 1.500 tokens, compacta la ventana de contexto cuando supera el 85 % e intenta recuperar contexto en los casos de desbordamiento.
Hay un detalle que conviene no perder de vista. AWS describe Strands como un agente de propósito general, no como un agente de programación. Todos los harnesses contra los que lo comparó —Claude Code, Codex, oh-my-pi, OpenCode y el de DeepSeek— se venden como agentes de código. No hay comparación contra otros agentes generales, así que la ventaja de tokens está medida en el terreno del rival, no en el propio.
Los investigadores de Amazon tienen pendiente publicar un artículo con más detalle de los benchmarks. Hasta entonces, quien quiera probarlo puede instalarlo y medir por su cuenta, porque el harness ya está disponible. Para un equipo que esté montando agentes sobre varios proveedores, tener una opción empaquetada y con gestión de contexto razonable por defecto ahorra bastante trabajo de fontanería, aunque el ahorro de tokens prometido haya que confirmarlo fuera de casa.

