Alianzas
D-Matrix conecta los XPUs Raptor a las fábricas de IA de NVIDIA mediante NVLink Fusion

El fabricante de chips de inferencia de IA d-Matrix anunció el 10 de septiembre de 2026 una colaboración de varios años en la hoja de ruta de productos con NVIDIA que integrará sus XPUs de inferencia Raptor de próxima generación en la arquitectura de escala de rack MGX de NVIDIA mediante NVLink Fusion, con disponibilidad inicial integrada en rack prevista para el cuarto trimestre de 2027.
d-Matrix afirmó que el acuerdo brinda a sus XPUs acceso al ecosistema de fábricas de IA de NVIDIA. Su pieza central es un sistema a nivel de rack habilitado con NVLink Fusion que, según d-Matrix, permitirá a laboratorios de IA, hiperescaladores y neoclouds ofrecer servicios de token de nivel premium con latencia ultrabaja. El cofundador y CEO de d-Matrix, Sid Sheth, describió la colaboración como un momento definitorio para la compañía, diciendo que los clientes podrán desplegar sus XPUs de inferencia junto a la plataforma de fábrica de IA de NVIDIA, ampliamente disponible.
NVIDIA indicó en una publicación de blog publicada el 10 de septiembre de 2026 que d-Matrix utilizará NVLink Fusion para conectar sus XPUs Raptor a la plataforma de infraestructura de IA de NVIDIA, añadiendo a d-Matrix a su lista de socios del ecosistema NVLink Fusion. “La demanda de inferencia está en auge, pero el capital, el tiempo y la energía siguen siendo finitos”, dijo Sheth durante una rueda de prensa, según NVIDIA. Afirmó que NVLink Fusion y MGX permiten a d-Matrix integrar los XPUs Raptor en una arquitectura ampliamente desplegada y refrigerada por líquido, reduciendo el tiempo y el riesgo de llevar su silicio de inferencia a un despliegue a gran escala.
En el anuncio de d-Matrix, el fundador y CEO de NVIDIA, Jensen Huang, dijo: “NVLink Fusion permite a los socios integrar silicio personalizado con el profundo ecosistema de NVIDIA de NVLink, empaquetado avanzado, sistemas de escala de rack y tecnologías de redes”. Huang añadió que, con la infraestructura de IA de NVIDIA operando en la nube y en centros de datos locales en todo el mundo, NVLink Fusion ofrece a socios como d-Matrix una vía para integrarse con las plataformas de cómputo de NVIDIA y amplía la elección de aceleradores para los clientes que construyen nuevas fábricas de IA.
Integración en Rack y Inferencia Desagregada
Según la hoja de ruta, d-Matrix colaborará con NVIDIA para incorporar sus XPUs de inferencia de próxima generación, comenzando con Raptor, directamente en el diseño de arquitectura de referencia de rack más reciente de NVIDIA, que incluye CPUs NVIDIA Vera, conmutadores NVLink, DPUs BlueField-4, SuperNICs ConnectX-9 y redes Ethernet Spectrum-X. El rack de d-Matrix, habilitado por la plataforma MGX, utilizará bandejas modulares sin cables fabricadas con el ecosistema y la cadena de suministro de MGX de NVIDIA.
d-Matrix también se asocia con Astera Labs, un proveedor de conectividad en el ecosistema NVLink Fusion, para ofrecer conectividad personalizada para flujos de datos de alto rendimiento en todo el sistema. El CEO de Astera Labs, Jitendra Mohan, afirmó que la asociación entre las compañías aporta conectividad de alto rendimiento diseñada a medida para la inferencia de IA de baja latencia al ecosistema NVLink Fusion.
Según NVIDIA, d-Matrix planea conectar sus XPUs en un único dominio de escala ascendente de gran ancho de banda y baja latencia mediante NVLink, y esos racks están diseñados para operar junto a sistemas NVIDIA basados en GPU, incluido el Vera Rubin NVL72, en implementaciones de inferencia desagregada.
d-Matrix afirmó que, con la desagregación heterogénea, los operadores pueden dividir las cargas de trabajo entre los XPUs Raptor y los sistemas Vera Rubin para optimizar cada fase de la inferencia. Para la codificación de IA, que la compañía describió como una de las aplicaciones desagregadas más populares actualmente, la fase de prellenado intensiva en cómputo se ejecuta en GPUs mientras que la fase de decodificación sensible a la latencia se ejecuta en sus XPUs. La empresa señaló que el sistema de rack está diseñado para aplicaciones sensibles a la latencia, como asistentes de codificación de IA, chatbots en tiempo real y agentes de voz, donde los clientes están dispuestos a pagar un precio premium por la velocidad.
Qué ofrece NVLink Fusion
NVIDIA describe NVLink Fusion como su plataforma para integrar XPUs y CPUs personalizados de terceros con la red de escala ascendente NVLink, la arquitectura de rack MGX y la plataforma completa de fábrica de IA que abarca cómputo, redes, almacenamiento, seguridad, energía, refrigeración y software. NVIDIA informa que la plataforma ofrece una latencia XPU‑a‑XPU tres veces menor que la del Ethernet comercial, tasas de paquetes diez veces superiores y 3 TB/s por XPU de ancho de banda total mediante NVLink de sexta generación.
En una descripción general de la plataforma publicada el 24 de agosto de 2026, NVIDIA declaró que el NVLink de sexta generación proporciona redes de gran ancho de banda y baja latencia en un dominio de 72 XPUs, y que NVLink‑C2C, que conecta XPUs a CPUs NVIDIA Vera u otras CPUs del ecosistema, brinda hasta 6 veces mayor eficiencia energética que una interfaz PCIe. La descripción señaló que NVLink Fusion se alinea con la arquitectura de referencia DSX de NVIDIA, que co‑diseña edificios, energía, refrigeración, cómputo y redes para fábricas de IA, y que el Blueprint de Fábrica de IA DSX de NVIDIA Omniverse suministra un gemelo digital y un diseño de referencia abierto para instalaciones a escala de gigavatios. NVIDIA también enumera software de soporte que incluye NCCL para cargas de trabajo distribuidas, Dynamo y NIXL para desagregación, y Mission Control para la gestión de clústeres, telemetría y depuración.
Los socios de NVLink Fusion enumerados por NVIDIA son d-Matrix, AWS, Arm, Intel, Fujitsu, SiFive, Alchip, Astera Labs, GUC, Marvell, MediaTek, Samsung, Cadence, Synopsys, Ayar Labs y Lightmatter, y la plataforma admite las arquitecturas de CPU Arm, x86 y RISC‑V junto a las GPUs de NVIDIA. NVIDIA denomina el modelo resultante una fábrica de IA semipersonalizada, en la que NVLink Fusion proporciona el interconector, la arquitectura de rack, el software y la cadena de suministro, mientras el socio se centra en el silicio diferenciado. La compañía afirmó que su plataforma de fábrica de IA de pila completa incluye el Vera Rubin NVL72, Groq 3 LPX, el rack de CPU Vera, el almacenamiento Vera BlueField‑4 STX y la red Ethernet Spectrum‑6 SPX.
Arquitectura Raptor y Disponibilidad
Raptor es la evolución de la plataforma XPU Corsair de d-Matrix, que está actualmente en producción, y amplía la arquitectura centrada en la memoria de la compañía. Mediante lo que d-Matrix describe como un enfoque de apilamiento 3D DRAM sin precedentes, Raptor combina un chip de memoria DRAM con un chip de cómputo SRAM en lo que la empresa denomina un paquete de dos niveles. El cofundador y CTO de d-Matrix, Sudeep Bhoja, presentó la tecnología 3D DRAM en la conferencia Hot Chips 2026.
d-Matrix afirmó que diseñó Raptor desde cero para su integración con NVLink Fusion y el ecosistema de rack a escala MGX de NVIDIA. La compañía anticipa que Raptor se fabricará antes de que termine 2026 y señaló que el XPU está siendo evaluado activamente en hiperescaladores de IA y laboratorios de vanguardia; d-Matrix indica que la plataforma cuenta con más de 100 patentes.
Se espera que la disponibilidad inicial de los XPUs Raptor integrados en el rack MGX de NVIDIA sea en el cuarto trimestre de 2027. d-Matrix está demostrando la tecnología en su stand en el AI Infra Summit.












