Apple presenta el chip A20 Pro con doble motor neural de 16 núcleos y 12 GB de RAM
El iPhone 18 Pro lleva el nuevo A20 Pro, que duplica la velocidad de inferencia frente al modelo anterior y permite ejecutar localmente un modelo de 27 B parámetros.

Apple ha anunciado el A20 Pro, su primer SoC con doble motor neural de 16 núcleos. La arquitectura está pensada exclusivamente para cargas de trabajo de IA y supera en rendimiento a cualquier otro Apple Silicon anterior. En la demostración oficial, un iPhone 18 Pro ejecutó el modelo Bonsai‑27B (27 000 000 000 parámetros) a una velocidad que el iPhone 17 Pro no alcanzaba, aproximadamente el doble de rapidez.
El dispositivo también incorpora 12 GB de LPDDR5X con un ancho de banda de 96 bits, lo que se traduce en una tasa de transferencia de 115,2 GB/s. Esa mejora de memoria, combinada con los dos motores neuronales, eleva el rendimiento de inferencia a niveles que antes requerían servidores de borde.
El modelo de referencia, Bonsai‑27B, es una versión de 1 bit de cuantización. Con 4 GB de RAM, la primera generación de Bonsai ya podía ejecutarse en teléfonos con menor capacidad, pero la versión de 2 bits que acompaña a Bonsai‑2 resulta demasiado voluminosa para caber íntegramente en la memoria del iPhone 18 Pro, provocando caídas de rendimiento. Por eso, la comunidad sigue prefiriendo la versión de 1 bit cuando se busca la mayor fluidez.
En términos de arquitectura interna, el motor neural alcanza un pico de rendimiento superior al de la GPU de 7 núcleos del chip cuando se trata de tareas exclusivamente de inferencia. La combinación de mayor ancho de banda de memoria y potencia dedicada evita los cuellos de botella típicos de los sistemas que comparten GPU y CPU para IA.
Los analistas esperan que Apple continúe ampliando la capacidad de memoria en futuras generaciones, lo que permitiría ejecutar modelos con aún más parámetros y complejidad sin sacrificar la latencia. Mientras tanto, el A20 Pro ya representa un salto significativo para los dispositivos móviles que desean ofrecer IA local sin depender de la nube.

