Partnerschappen
D-Matrix verbindt Raptor XPUs met NVIDIA AI-fabrieken via NVLink Fusion

AI-inferentiechipfabrikant d-Matrix kondigde op 10 september 2026 een meerjaren product‑roadmap‑samenwerking met NVIDIA aan, waarbij haar volgende‑generatie Raptor‑inference‑XPUs in de MGX‑rack‑scale‑architectuur van NVIDIA worden geïntegreerd via NVLink Fusion, met een eerste rack‑geïntegreerde beschikbaarheid verwacht in het vierde kwartaal van 2027.
d-Matrix stelt dat de overeenkomst haar XPUs toegang geeft tot het AI‑factory‑ecosysteem van NVIDIA. Het middelpunt is een rack‑niveau systeem dat NVLink Fusion‑enabled is en volgens d-Matrix AI‑labs, hyperscalers en neoclouds in staat stelt premium‑token‑diensten met ultralage latentie aan te bieden. Medeoprichter en CEO van d-Matrix, Sid Sheth, beschreef de samenwerking als een bepalend moment voor het bedrijf en zei dat klanten haar inference‑XPUs naast het breed beschikbare NVIDIA AI‑factory‑platform kunnen inzetten.
NVIDIA meldde in een blogbericht gepubliceerd op 10 september 2026 dat d-Matrix NVLink Fusion zal gebruiken om haar Raptor‑XPUs te verbinden met het AI‑infrastructuurplatform van NVIDIA, waarmee d-Matrix wordt toegevoegd aan de lijst van NVLink Fusion‑ecosysteempartners. “De vraag naar inference stijgt enorm, maar kapitaal, tijd en energie blijven beperkt,” zei Sheth tijdens een persbriefing, aldus NVIDIA. Hij verklaarde dat NVLink Fusion en MGX d-Matrix in staat stellen Raptor‑XPUs te integreren in een breed uitgerolde, vloeistofgekoelde architectuur, waardoor de tijd en het risico om haar inference‑silicon op grote schaal in te zetten worden verminderd.
In de d-Matrix‑aankondiging zei NVIDIA‑oprichter en CEO Jensen Huang zei: “NVLink Fusion stelt partners in staat om maatwerk‑silicon te integreren met het uitgebreide NVLink‑ecosysteem van NVIDIA, geavanceerde verpakking, rack‑scale‑systemen en netwerktechnologieën.” Huang voegde daaraan toe dat, met de NVIDIA AI‑infrastructuur die wereldwijd draait in cloud‑ en on‑premise‑datacenters, NVLink Fusion partners zoals d‑Matrix een route biedt om te integreren met NVIDIA‑computplatformen en de keuze aan versnellers vergroot voor klanten die nieuwe AI‑fabrieken bouwen.
Rackintegratie en gedisaggregeerde inference
Volgens de roadmap zal d-Matrix samenwerken met NVIDIA om haar volgende‑generatie inference‑XPUs, te beginnen met Raptor, rechtstreeks in het nieuwste rack‑referentie‑architectuurontwerp van NVIDIA te integreren, dat NVIDIA Vera‑CPU’s, NVLink‑switches, BlueField‑4‑DPU’s, ConnectX‑9‑SuperNIC’s en Spectrum‑X‑Ethernet‑netwerken bevat. Het d‑Matrix‑rack, mogelijk gemaakt door het MGX‑platform, zal modulaire, kabelvrije trays gebruiken die zijn opgebouwd met het MGX‑ecosysteem en de toeleveringsketen van NVIDIA.
d‑Matrix werkt ook samen met Astera Labs, een connectiviteitsleverancier in het NVLink Fusion‑ecosysteem, om maatwerk‑connectiviteit te leveren voor high‑throughput datastromen door het hele systeem. Astera Labs‑CEO Jitendra Mohan verklaarde dat de samenwerking purpose‑built, high‑throughput‑connectiviteit voor low‑latency AI‑inference naar het NVLink Fusion‑ecosysteem brengt.
Volgens NVIDIA is d‑Matrix van plan haar XPUs te verbinden in één high‑bandwidth, low‑latency scale‑up‑domein met behulp van NVLink, en zijn die racks ontworpen om naast GPU‑gebaseerde NVIDIA‑systemen, waaronder de Vera Rubin NVL72, te opereren in gedisaggregeerde inference‑implementaties.
d‑Matrix stelt dat met heterogene disaggregatie operators workloads kunnen verdelen tussen Raptor‑XPUs en Vera Rubin‑systemen om elke fase van inference te optimaliseren. Voor AI‑codering, die het bedrijf beschrijft als een van de populairste huidige gedisaggregeerde toepassingen, draait de rekentijd‑intensieve prefill‑fase op GPU’s terwijl de latentie‑gevoelige decode‑fase op haar XPUs plaatsvindt. Het bedrijf zegt dat het rack‑systeem is ontworpen voor latentie‑gevoelige toepassingen zoals AI‑code‑assistenten, realtime‑chatbots en spraak‑agents, waarbij klanten bereid zijn een premie te betalen voor snelheid.
Wat NVLink Fusion Biedt
NVIDIA beschrijft NVLink Fusion als haar platform voor het integreren van derde‑partij maatwerk‑XPUs en CPU’s met NVLink scale‑up‑netwerken, de MGX‑rack‑architectuur en het volledige AI‑factory‑platform dat compute, networking, storage, security, power, cooling en software omvat. NVIDIA meldt dat het platform een 3‑maal lagere XPU‑naar‑XPU‑latentie levert dan standaard Ethernet, 10‑maal hogere pakket‑snelheden en 3 TB/s per XPU aan all‑to‑all‑bandbreedte via de zesde‑generatie NVLink.
In een platformoverzicht gepubliceerd op 24 augustus 2026 verklaarde NVIDIA dat de zesde‑generatie NVLink hoge‑bandbreedte, low‑latency‑netwerken biedt over een domein van 72 XPUs, en dat NVLink‑C2C, dat XPUs verbindt met NVIDIA Vera‑CPU’s of andere ecosysteem‑CPU’s, tot 6‑maal meer energie‑efficiëntie levert dan een PCIe‑interface. Het overzicht stelde dat NVLink Fusion aansluit bij NVIDIA’s DSX‑referentie‑architectuur, die gebouwen, stroom, koeling, compute en networking co‑ontwerpt voor AI‑fabrieken, en dat de NVIDIA Omniverse DSX AI Factory Blueprint een digitale tweeling en een open referentie‑ontwerp levert voor gigawatt‑schaal faciliteiten. NVIDIA somt ook ondersteunende software op, waaronder NCCL voor gedistribueerde workloads, Dynamo en NIXL voor disaggregatie, en Mission Control voor cluster‑beheer, telemetrie en debugging.
De door NVIDIA genoemde NVLink Fusion‑partners zijn d‑Matrix, AWS, Arm, Intel, Fujitsu, SiFive, Alchip, Astera Labs, GUC, Marvell, MediaTek, Samsung, Cadence, Synopsys, Ayar Labs en Lightmatter, en het platform ondersteunt de Arm-, x86- en RISC‑V‑CPU‑architecturen naast NVIDIA‑GPU’s. NVIDIA noemt het resulterende model een semi‑custom AI‑factory, waarin NVLink Fusion de interconnect, rack‑architectuur, software en toeleveringsketen levert, terwijl de partner zich richt op gedifferentieerde siliconen. Het bedrijf meldt dat haar full‑stack AI‑factory‑platform onder meer de Vera Rubin NVL72, Groq 3 LPX, het Vera‑CPU‑rack, Vera BlueField‑4 STX‑storage en Spectrum‑6 SPX‑Ethernet‑networking omvat.
Raptor‑architectuur en Beschikbaarheid
Raptor is de opvolger van d‑Matrix’s Corsair‑XPU‑platform, dat momenteel in productie is, en breidt de geheugen‑centrische architectuur van het bedrijf uit. Via wat d‑Matrix beschrijft als een eerste‑in‑zijn‑soort 3D‑DRAM‑stack‑benadering, combineert Raptor een DRAM‑geheugenchip met een SRAM‑rekenchip in wat het bedrijf een enkel tweelaags pakket noemt. Medeoprichter en CTO van d‑Matrix, Sudeep Bhoja, gaf een preview van de 3D‑DRAM‑technologie op de Hot Chips‑conferentie 2026.
d‑Matrix stelt dat het Raptor vanaf de basis heeft ontworpen voor integratie met NVLink Fusion en het NVIDIA MGX‑rack‑scale‑ecosysteem. Het bedrijf verwacht dat Raptor vóór het einde van 2026 wordt getaped en meldt dat de XPU actief wordt geëvalueerd bij AI‑hyperscalers en frontier‑labs; d‑Matrix geeft aan dat het platform wordt ondersteund door meer dan 100 patenten.
De eerste beschikbaarheid van Raptor‑XPUs geïntegreerd in het NVIDIA MGX‑rack wordt verwacht in het vierde kwartaal van 2027. d‑Matrix demonstreert de technologie op haar stand op de AI Infra Summit.












