Apple publica su matriz de IA local: del iPhone con 16 GB al clúster de Mac Studio
Apple enseña en el JNUC la tabla que cruza memoria unificada y ancho de banda con el techo de parámetros activos que aguanta cada equipo, del iPhone al clúster de Mac Studio.

Apple ha enseñado la tabla que faltaba para saber hasta dónde llega cada equipo de su gama ejecutando modelos en local. La mostró en el JNUC, la conferencia anual de usuarios de Jamf, dentro de una sesión sobre el estado del sector TI, y el detalle se ha conocido por una publicación en X. El cuadro cruza memoria unificada, ancho de banda y el techo de parámetros activos que soporta cada máquina.
Los números, tal como los presentó la compañía:
- iPhone y iPad: 16 GB, 76 GB/s, hasta 14.000 millones de parámetros activos.
- MacBook Air: 32 GB, 153 GB/s, hasta 35.000 millones.
- Mac mini: 64 GB, 307 GB/s, hasta 70.000 millones.
- MacBook Pro: 128 GB, 614 GB/s, hasta 120.000 millones.
- Mac Studio: 512 GB, 1,2 TB/s, hasta 480.000 millones.
- Clúster de Mac Studio: 2 TB, 1,2 TB/s, hasta 1,6 billones.
El cuello de botella es la memoria
Todo cuelga de la memoria unificada. La capacidad marca cuánto peso cabe, y el ancho de banda marca a qué velocidad se mueve ese peso entre CPU, GPU y Neural Engine en cada token. Por eso la escalera es tan limpia: cada salto de gama dobla aproximadamente memoria y velocidad, y el techo de parámetros sube en la misma proporción. Un Mac mini con 64 GB ya mueve modelos que no caben en ninguna tarjeta de consumo con 16 o 24 GB de VRAM, aunque a menos tokens por segundo.
Conviene fijarse en una palabra: Apple habla de parámetros activos, los que se recorren en cada token, no del tamaño total del modelo. En arquitecturas MoE ambos números se separan mucho, así que la cifra no equivale al peso del fichero que uno pueda meter en disco. Un modelo con 200.000 millones de parámetros totales y 20.000 millones activos puede encajar en un equipo cuya fila marca bastante menos.
En el JNUC, la cita es obligada para quien gestiona flotas de Apple en empresa: administradores de sistemas, responsables de seguridad y de compras que llevan años eligiendo Mac por autonomía y gestión, no por cómputo. La tabla convierte esa decisión en algo más medible. Si el plan pasa por inferencia con datos que no pueden salir del portátil, ya hay una referencia de qué hardware hace falta y cuál se queda corto.
Lo que no hay es nada más. Ni una demo, ni una cifra de latencia, ni tokens por segundo, ni consumo, ni un benchmark de por medio. El dato es de Apple y solo de Apple, presentado en una diapositiva de una sesión para administradores. Tampoco ha detallado qué runtime o qué cuantización asume la tabla, que es justo lo que decide si esos techos se cumplen en la práctica o se quedan en el papel. Para comparar de verdad habrá que esperar a que alguien mida lo mismo sobre el hardware en la mesa.

