AI Infrastructure2026-09-12NVIDIA AI Blog

d-Matrix usa NVLink Fusion en sus XPU Raptor

La especialista en chips de inferencia de IA d-Matrix ha anunciado que sus XPU Raptor de próxima generación se conectarán a la plataforma de infraestructura de IA de NVIDIA mediante NVLink Fusion. La integración combina el silicio de inferencia de d-Matrix con la interconexión de escalado NVLink de NVIDIA y la red de escalado horizontal Spectrum-X, lo que permite a la compañía construir sistemas de rack sobre el ecosistema de interconexión de NVIDIA. El anuncio coloca a d-Matrix entre un grupo cada vez mayor de socios que diseñan hardware en torno a los estándares de interconexión de NVIDIA en lugar de competir con ellos. Esa posición es cada vez más importante a medida que la industria desplaza su atención del rendimiento de cómputo bruto a la eficiencia con que se pueden servir grandes modelos en muchos chips. Para las cargas de inferencia en particular, el ancho de banda y la latencia de la interconexión suelen determinar el rendimiento real. Servir un modelo de lenguaje grande en un rack de aceleradores requiere comunicación constante y de alta velocidad entre chips, y los cuellos de botella ahí pueden borrar las ganancias de procesadores individuales más rápidos. Al adoptar NVLink Fusion, d-Matrix obtiene una estructura de alta velocidad probada para la comunicación de escalado, mientras que Spectrum-X gestiona el tráfico entre racks. El movimiento también señala una tendencia más amplia: NVIDIA posiciona su tecnología de interconexión como una capa base sobre la que otros fabricantes de chips pueden construir, extendiendo su influencia más allá de sus propias GPU. Para d-Matrix, la alianza podría acelerar la adopción entre operadores de centros de datos ya estandarizados en infraestructura NVIDIA, reduciendo la fricción de integración y acortando los plazos de despliegue. Los detalles sobre plazos, cifras de rendimiento y qué clientes desplegarán primero los sistemas basados en Raptor siguen siendo limitados. Aun así, el anuncio subraya una realidad clave de la era de los centros de datos de IA: a medida que los modelos crecen y la demanda de inferencia se dispara, la red que conecta los chips puede importar tanto como los propios chips.

Noticias relacionadas