BookinglyTech News
Inteligencia artificial

Axelera AI pone a la venta Europa, su segundo chip de inferencia: 629 TOPS a 45 W

El SoC neerlandés integra ocho núcleos de IA y dieciséis núcleos vectoriales RISC-V, admite INT4, INT8 e INT16 y se venderá tanto en formato chip como en tarjeta PCIe

2 min de lecturaITHome0 vistas

Axelera AI ya vende Europa, su AIPU de segunda generación. El SoC entrega 629 TOPS a través de ocho núcleos de procesamiento de IA y suma dieciséis núcleos vectoriales RISC-V. Todo el conjunto funciona con 45 W de consumo total y la empresa lo comercializa de dos maneras: el chip por separado y una tarjeta aceleradora PCIe (AIC).

La firma neerlandesa ya había presentado el producto antes de abrir pedidos, así que lo nuevo es la disponibilidad real y la ficha técnica cerrada.

Qué lleva dentro

Europa admite los formatos de datos INT4, INT8 e INT16, lo que da margen para elegir entre precisión y rendimiento según el modelo que se vaya a servir. Lleva 128 MB de caché L2 en el propio die, lo que reduce el tráfico hacia memoria en cargas de inferencia con pesos que se reutilizan mucho.

En el apartado de E/S, soporta memoria LPDDR5 de 256 bits y expone cuatro carriles PCIe Gen4. El presupuesto térmico de 45 W es lo que más condiciona el despliegue: son cifras de tarjeta pasiva o de chasis con ventilación modesta, no de acelerador que obligue a repensar la refrigeración del rack.

Las cifras de rendimiento que acompañan al lanzamiento son de la propia Axelera. La compañía sostiene que el token por vatio de Europa multiplica por seis el de una solución basada en GPU, y que a igual precio su throughput de tokens supera en más de ocho veces al del mejor competidor. No hay cifras de terceros ni comparativas con modelos concretos, así que conviene tratar esa parte como material de marketing hasta que aparezcan benchmarks independientes.

Por qué mirarlo

El interés aquí no está en el TOPS bruto, sino en la relación entre vatio, precio y token servido. Quien monta inferencia en producción sabe que el coste real de servir un modelo se decide en esa ecuación, no en la hoja de especificaciones. Un acelerador de 45 W que se pincha en un PCIe Gen4 y se alimenta solo de la ranura cambia los números de densidad por rack frente a soluciones que piden 300 W o más por tarjeta.

Queda por ver el soporte de software, que es donde han tropezado casi todos los aceleradores de inferencia que no vienen de los grandes: runtimes propios, compatibilidad con los frameworks habituales y cuánto trabajo hay que meter para portar un modelo ya entrenado. Axelera no ha detallado precios ni qué compiladores o librerías acompañan al chip.