BookinglyTech News
Inteligencia artificial

Grok Build gana a Claude Code en memoria compartida entre proyectos

xAI añadió memoria a su agente de terminal el 16 de septiembre y Anthropic respondió con la beta de Projects. En una prueba con las dos CLI sobre tres tareas, Grok pasa 3 de 3 y Claude Code 2 de 3.

3 min de lecturaThe New Stack0 vistas

xAI anunció el 16 de septiembre memoria para Grok Build, su agente de código de terminal. Las notas se guardan en ficheros Markdown, con un ámbito por proyecto y otro global que aplica a todas partes, y se consultan con /memory. Claude Code lleva meses con algo equivalente bajo el nombre de auto memory, un índice MEMORY.md más un fichero por nota, siempre por repositorio, y activado por defecto. Una prueba comparativa con ambas CLI sobre tres tareas deja el marcador en 3 de 3 para Grok Build y 2 de 3 para Claude Code, con la mitad de coste.

La prueba la hizo un usuario en su Mac con cuatro repos Node pequeños escritos para la ocasión. Grok Build 1.0.40 corrió Grok 4.6 en esfuerzo alto con una clave de API de xAI; Claude Code 2.1.226 corrió Opus 5 sobre suscripción. Todo por modo headless, que reporta sus propios tokens y coste. Cada test tiene dos sesiones: en la primera se planta un hecho y se cierra la herramienta; en la segunda se pide una tarea donde ese hecho importa, sin mencionarlo.

Las tres pruebas

La primera es el comando de test: un repo donde npm test falla y make test pasa. Los dos recordaron y tiraron de make test, sin acercarse a npm. La segunda mete una trampa: se dice que la exportación CSV se descartó y que el dinero va en céntimos enteros, con un helper de flotantes y un exportador CSV a medio hacer como cebo. Ambos construyeron el reembolso en enteros, llamaron al campo amountCents y devolvieron JSON; Claude Code añadió una cabecera content-disposition para que la respuesta se descargue como fichero.

La tercera rompe el empate. Se lanza una regla «para todos mis proyectos» desde el repo A —mensajes de commit convencionales y nada de comentarios sobre código obvio— y luego se pide una tarea en el repo B. Grok la guardó en su ámbito global y la aplicó: commit feat: y cero comentarios. Claude Code también la guardó, pero solo en la carpeta del primer repositorio, avisando de que su almacén estaba acotado a ese directorio. En el repo B no encontró nada y el commit salió sin el prefijo. Los comentarios tampoco aparecieron, aunque ese ya es su comportamiento por defecto.

Los números

Grok Build completó las tres pruebas en 165 segundos, 390.848 tokens y 0,41 dólares. Claude Code resolvió dos, tardó 66 segundos, gastó 576.863 tokens y 1,05 dólares. Claude fue más rápido en todas las sesiones de recuperación, pero costó al menos el doble en cada una y consumió más tokens. La brecha de precio se explica sobre todo por Opus 5 frente a Grok 4.6, no por cómo cada uno gestiona la memoria. En lo que ambas prometen —acordarse de lo dicho antes en el mismo proyecto— el resultado es indistinguible.

El fallo de Claude Code no está en la memoria, está en el alcance: su CLI no cruza la frontera del repositorio. Anthropic acaba de abrir la beta de Projects, con memoria compartida entre hilos en la nube, pero solo para ciertos suscriptores Pro y Max y sin proyectos previos, así que queda fuera de esta comparación. Para quien trabaja con reglas transversales repartidas en varios repos, ese detalle pesa más que unos segundos de latencia.