Partnerskaber
D-Matrix forbinder Raptor XPU’er med NVIDIA AI-fabrikker via NVLink Fusion

AI-inference chipproducenten d-Matrix annoncerede den 10. september 2026 et flerårigt produkt-roadmap‑samarbejde med NVIDIA, der vil integrere deres næste generations Raptor‑inference‑XPU’er i NVIDIAs MGX rack‑scale‑arkitektur via NVLink Fusion, med første rack‑integrerede tilgængelighed forventet i fjerde kvartal af 2027.
d-Matrix sagde, at aftalen giver deres XPU’er adgang til NVIDIAs AI‑factory‑økosystem. Hovedpunktet er et rack‑niveau system aktiveret med NVLink Fusion, som d-Matrix hævder vil gøre det muligt for AI‑laboratorier, hyperscalere og neocloud‑udbydere at tilbyde premium‑niveau token‑tjenester med ultralav latenstid. d-Matrix medstifter og administrerende direktør Sid Sheth beskrev samarbejdet som et afgørende øjeblik for virksomheden og sagde, at kunder vil kunne implementere deres inference‑XPU’er sammen med den bredt tilgængelige NVIDIA AI‑factory‑platform.
NVIDIA sagde i et blogindlæg offentliggjort den 10. september 2026, at d-Matrix vil bruge NVLink Fusion til at forbinde deres Raptor‑XPU’er med NVIDIAs AI‑infrastrukturplatform, hvilket tilføjer d-Matrix til deres liste over NVLink Fusion‑økosystempartnere. “Efterspørgslen efter inference skyder i vejret, men kapital, tid og energi er begrænsede,” sagde Sheth under en pressebriefing, ifølge NVIDIA. Han forklarede, at NVLink Fusion og MGX gør det muligt for d-Matrix at integrere Raptor‑XPU’er i en bredt udrullet, væskekølet arkitektur, hvilket reducerer tid og risiko ved at bringe deres inference‑silicium i stor‑skala produktion.
I d-Matrix‑meddelelsen sagde NVIDIAs grundlægger og administrerende direktør Jensen Huang: “NVLink Fusion gør det muligt for partnere at integrere specialtilpasset silicium med NVIDIAs dybe økosystem af NVLink, avanceret pakning, rack‑scale‑systemer og netværksteknologier.” Huang tilføjede, at med NVIDIAs AI‑infrastruktur, der kører i skyen og i on‑premise datacentre verden over, giver NVLink Fusion partnere som d-Matrix en vej til at integrere med NVIDIAs compute‑platforme og udvider accelerator‑valget for kunder, der bygger nye AI‑fabrikker.
Rack‑integration og disaggregeret inference
I henhold til roadmap’en vil d-Matrix samarbejde med NVIDIA om at indarbejde deres næste generations inference‑XPU’er, startende med Raptor, direkte i NVIDIAs nyeste rack‑reference‑arkitektur, som omfatter NVIDIA Vera‑CPU’er, NVLink‑switches, BlueField‑4‑DPU’er, ConnectX‑9‑SuperNIC’er og Spectrum‑X‑Ethernet‑netværk. d-Matrix‑racket, aktiveret af MGX‑platformen, vil bruge modulære, kabelfrie bakker fremstillet med NVIDIAs MGX‑økosystem og forsyningskæde.
d-Matrix samarbejder også med Astera Labs, en forbindelsesleverandør i NVLink Fusion‑økosystemet, for at levere skræddersyet forbindelse til høj‑gennemstrømmende dataflow i hele systemet. Astera Labs administrerende direktør Jitendra Mohan sagde, at partnerskabet mellem virksomhederne bringer formålsbygget, høj‑gennemstrømmende forbindelse til lav‑latens AI‑inference i NVLink Fusion‑økosystemet.
Ifølge NVIDIA planlægger d-Matrix at forbinde deres XPU’er i et enkelt høj‑båndbredde, lav‑latens skalerings‑domæne ved brug af NVLink, og disse rack er designet til at fungere ved siden af GPU‑baserede NVIDIA‑systemer, herunder Vera Rubin NVL72, i disaggregated inference‑implementeringer.
d-Matrix sagde, at med heterogen disaggregation kan operatører opdele arbejdsbelastninger mellem Raptor‑XPU’er og Vera Rubin‑systemer for at optimere hver fase af inference. For AI‑kodning, som virksomheden beskrev som en af de mest populære nuværende disaggregated‑applikationer, kører den beregningstunge prefill‑fase på GPU’er, mens den latens‑følsomme decode‑fase kører på deres XPU’er. Virksomheden oplyste, at rack‑systemet er designet til latens‑følsomme applikationer såsom AI‑kodningsassistenter, real‑time chatbots og stemmeagenter, hvor kunder er villige til at betale en præmie for hastighed.
Hvad NVLink Fusion leverer
NVIDIA beskriver NVLink Fusion som deres platform til integration af tredjeparts specialtilpassede XPU’er og CPU’er med NVLink skalerings‑netværk, MGX‑rack‑arkitekturen og den fulde AI‑factory‑platform, der dækker compute, netværk, lager, sikkerhed, strøm, køling og software. NVIDIA rapporterer, at platformen leverer 3‑gange lavere XPU‑til‑XPU‑latens end standard Ethernet, 10‑gange højere pakkefrekvens og 3 TB/s per XPU af all‑to‑all‑båndbredde via den sjette generation NVLink.
I en platformoversigt offentliggjort den 24. august 2026 oplyste NVIDIA, at den sjette generation NVLink leverer høj‑båndbredde, lav‑latens netværk på tværs af et 72‑XPU‑domæne, og at NVLink‑C2C, som forbinder XPU’er med NVIDIA Vera‑CPU’er eller andre økosystem‑CPU’er, giver op til 6‑gange højere energieffektivitet end en PCIe‑grænseflade. Oversigten sagde, at NVLink Fusion er i overensstemmelse med NVIDIAs DSX‑reference‑arkitektur, som med‑designer bygninger, strøm, køling, compute og netværk for AI‑fabrikker, og at NVIDIA Omniverse DSX AI Factory Blueprint leverer en digital tvilling og et åbent reference‑design for gigawatt‑skala faciliteter. NVIDIA nævner også understøttende software, herunder NCCL til distribuerede arbejdsbelastninger, Dynamo og NIXL til disaggregation, samt Mission Control til klynge‑styring, telemetri og fejlfinding.
NVIDIAs opregnede NVLink Fusion‑partnere er d-Matrix, AWS, Arm, Intel, Fujitsu, SiFive, Alchip, Astera Labs, GUC, Marvell, MediaTek, Samsung, Cadence, Synopsys, Ayar Labs og Lightmatter, og platformen understøtter Arm-, x86- og RISC‑V‑CPU‑arkitekturer sammen med NVIDIA‑GPU’er. NVIDIA kalder den resulterende model for en semi‑custom AI‑factory, hvor NVLink Fusion leverer interconnect, rack‑arkitektur, software og forsyningskæde, mens partneren fokuserer på differentieret silicium. Virksomheden sagde, at deres full‑stack AI‑factory‑platform omfatter Vera Rubin NVL72, Groq 3 LPX, Vera CPU‑rack, Vera BlueField‑4 STX‑lager og Spectrum‑6 SPX Ethernet‑netværk.
Raptor‑arkitektur og tilgængelighed
Raptor er efterfølgeren til d-Matrix’ Corsair‑XPU‑platform, som i øjeblikket er i produktion, og udvider virksomhedens hukommelses‑centrerede arkitektur. Gennem det, som d-Matrix beskriver som en banebrydende 3D‑DRAM‑stakningsmetode, kombinerer Raptor en DRAM‑hukommelseschip med en SRAM‑compute‑chip i det, virksomheden kalder en enkelt to‑etagers pakke. d-Matrix medstifter og CTO Sudeep Bhoja præsenterede 3D‑DRAM‑teknologien på Hot Chips‑konferencen 2026.
d-Matrix sagde, at de designede Raptor fra bunden til integration med NVLink Fusion og NVIDIAs MGX rack‑scale‑økosystem. Virksomheden forventer, at Raptor vil blive tape‑out før udgangen af 2026 og oplyste, at XPU’en aktivt evalueres hos AI‑hyperscalere og frontier‑laboratorier; d-Matrix angiver, at platformen er understøttet af mere end 100 patenter.
Den første tilgængelighed af Raptor‑XPU’er integreret i NVIDIAs MGX‑rack forventes i fjerde kvartal af 2027. d-Matrix demonstrerer teknologien på deres stand på AI Infra Summit.












