BookinglyTech News
Hardware

Inspur anuncia un supernodo con 128 chips de IA propios y 8 TB de memoria unificada

La compañía china promete 5,85 ms por token moviendo un modelo de 2,8 billones de parámetros. Son cifras suyas: no hay demo ni especificaciones técnicas.

2 min de lecturaPandaily0 vistas

En el AICC2026, Inspur Information ha presentado el MetaBrain SD200 Ultra, un supernodo que integra 128 aceleradores de fabricación china en un único sistema, con 8 TB de memoria unificada para todos ellos. La compañía afirma que mueve Kimi K3, un modelo de 2,8 billones de parámetros, por debajo de 5,85 milisegundos por token.

Chips locales y un solo dominio de memoria

El dato de los 128 chips es el que separa este anuncio de lo que suele firmar el mismo fabricante con aceleradores de terceros. Inspur es uno de los grandes nombres del hardware de servidor en China, y aquí lo que vende es un supernodo armado con silicio local. La presentación no dice de qué chip se trata, ni cuántos vatios consume el conjunto, ni qué interconnect une las 128 piezas.

El término doméstico tiene lectura inmediata en el mercado chino: aceleradores diseñados para no depender de proveedores sujetos a los controles de exportación estadounidenses.

Los 8 TB de memoria unificada apuntan al mismo problema. Un modelo de 2,8 billones de parámetros, incluso con cuantización agresiva, ocupa varios terabytes, así que servirlo desde un solo dominio de memoria evita el reparto entre nodos y la latencia de red que trae ese reparto. Es la parte del anuncio con más consecuencias para quien despliega inferencia.

La latencia es la otra cifra. 5,85 milisegundos por token equivalen a unos 171 tokens por segundo, una velocidad que en generación de texto se percibe. Lo que no aclara el anuncio es si ese número es por usuario o agregado, con qué tamaño de lote ni con qué longitud de contexto.

Lo que falta

No hay demo pública, ni precio, ni fecha de disponibilidad, ni clientes, ni consumo del nodo. Inspur tampoco ha dicho cuántos de esos chips es capaz de producir ni si el sistema se podrá comprar fuera de China. La comparación contra un sistema equivalente de otro fabricante, que es lo que interesa a quien firma la compra, no aparece por ningún lado.

Para quien administra clústeres de inferencia, la dirección del anuncio es clara: memoria unificada grande y aceleradores locales. Todo lo demás son cifras del fabricante, y estas cosas se miden cuando alguien de fuera pone el cronómetro.