Partnerskap
D‑Matrix kopplar Raptor XPU:er till NVIDIAs AI‑fabriker via NVLink Fusion

AI‑inferenzchipstillverkaren d-Matrix meddelade den 10 september 2026 ett flerårigt produkt‑färdplan‑samarbete med NVIDIA som kommer att integrera företagets nästa generations Raptor‑inferenz‑XPU:er i NVIDIAs MGX‑rack‑skalarkitektur via NVLink Fusion, med första rack‑integrerade tillgänglighet förväntad under fjärde kvartalet 2027.
d-Matrix säger att avtalet ger dess XPU:er tillgång till NVIDIAs AI‑fabrik‑ekosystem. Huvudkomponenten är ett rack‑nivå‑system med NVLink Fusion‑stöd som d-Matrix menar kommer att låta AI‑laboratorier, hyperscalers och neocloud‑leverantörer erbjuda premium‑tjänster med extremt låg latens. d-Matrix medgrundare och VD Sid Sheth beskrev samarbetet som ett avgörande ögonblick för företaget och sade att kunderna kommer att kunna distribuera dess inferens‑XPU:er tillsammans med den brett tillgängliga NVIDIAs AI‑fabrik‑plattform.
NVIDIA uppgav i ett blogginlägg publicerat den 10 september 2026 att d-Matrix kommer att använda NVLink Fusion för att ansluta sina Raptor‑XPU:er till NVIDIAs AI‑infrastrukturplattform, vilket lägger till d-Matrix i deras lista över NVLink Fusion‑ekosystempartner. ”Efterfrågan på inferens skjuter i höjden, men kapital, tid och energi är begränsade,” sade Sheth under en presskonferens, enligt NVIDIA. Han förklarade att NVLink Fusion och MGX gör det möjligt för d-Matrix att integrera Raptor‑XPU:er i en brett distribuerad, vätskekyld arkitektur, vilket minskar tid och risk för att föra deras inferens‑silicon till storskalig utrullning.
I d-Matrix‑annonseringen sade NVIDIAs grundare och VD Jensen Huang: ”NVLink Fusion möjliggör för partners att integrera skräddarsytt kisel med NVIDIAs djupa ekosystem av NVLink, avancerad paketering, rack‑skalssystem och nätverksteknologier.” Huang tillade att, med NVIDIAs AI‑infrastruktur som körs över moln och lokala datacenter världen över, ger NVLink Fusion partners som d-Matrix en väg att integrera med NVIDIAs beräkningsplattformar och breddar accelerator‑utbudet för kunder som bygger nya AI‑fabriker.
Rack‑integration och disaggregerad inferens
Enligt färdplanen kommer d-Matrix att samarbeta med NVIDIA för att införliva sina nästa generations inferens‑XPU:er, med start i Raptor, direkt i NVIDIAs senaste rack‑referensarkitektur, som innehåller NVIDIA Vera‑CPU:er, NVLink‑switchar, BlueField‑4‑DPU:er, ConnectX‑9‑SuperNIC:ar och Spectrum‑X‑Ethernet‑nätverk. d-Matrix‑racket, som drivs av MGX‑plattformen, kommer att använda modulära, kabelfria brickor byggda med NVIDIAs MGX‑ekosystem och leveranskedja.
d-Matrix samarbetar också med Astera Labs, en leverantör av anslutningar i NVLink Fusion‑ekosystemet, för att leverera skräddarsydd anslutning för hög genomströmning av data i hela systemet. Astera Labs VD Jitendra Mohan sade att partnerskapet mellan företagen ger ändamålsenlig, höggenomströmmande anslutning för låg‑latens AI‑inferens till NVLink Fusion‑ekosystemet.
Enligt NVIDIA planerar d-Matrix att ansluta sina XPU:er i ett enda högbandbredds‑, låg‑latens‑skal‑upp‑domän med NVLink, och dessa rack är konstruerade för att fungera bredvid GPU‑baserade NVIDIA‑system, inklusive Vera Rubin NVL72, i disaggregerade inferens‑utplaceringar.
d-Matrix uppgav att med heterogen disaggregation kan operatörer dela upp arbetsbelastningar mellan Raptor‑XPU:er och Vera Rubin‑system för att optimera varje fas av inferensen. För AI‑kodning, som företaget beskriver som en av de mest populära nuvarande disaggregerade applikationerna, körs den beräkningsintensiva förfyllningsfasen på GPU:er medan den latenskänsliga avkodningsfasen körs på dess XPU:er. Företaget säger att rack‑systemet är utformat för latenskänsliga applikationer såsom AI‑kodningsassistenter, realtids‑chatbots och röstagenter, där kunderna är villiga att betala extra för hastigheten.
Vad NVLink Fusion erbjuder
NVIDIA beskriver NVLink Fusion som sin plattform för att integrera tredjeparts‑anpassade XPU:er och CPU:er med NVLink‑skal‑upp‑nätverk, MGX‑rack‑arkitektur och hela AI‑fabrik‑plattformen som omfattar beräkning, nätverk, lagring, säkerhet, ström, kylning och mjukvara. NVIDIA rapporterar att plattformen levererar tre gånger lägre XPU‑till‑XPU‑latens än standard‑Ethernet, tio gånger högre paketfrekvens och 3 TB/s per XPU av all‑till‑all‑bandbredd via sjätte‑generationens NVLink.
I en plattformöversikt publicerad den 24 augusti 2026 angav NVIDIA att sjätte‑generationens NVLink tillhandahåller hög bandbredd och låg latens över ett 72‑XPU‑domän, och att NVLink‑C2C, som ansluter XPU:er till NVIDIA Vera‑CPU:er eller andra ekosystem‑CPU:er, levererar upp till sex gånger högre energieffektivitet än ett PCIe‑gränssnitt. Översikten sade att NVLink Fusion är i linje med NVIDIAs DSX‑referensarkitektur, som samdesignar byggnader, ström, kylning, beräkning och nätverk för AI‑fabriker, och att NVIDIA Omniverse DSX AI Factory Blueprint tillhandahåller en digital tvilling och öppen referensdesign för gigawatt‑skaliga anläggningar. NVIDIA listar också stödjande mjukvara som NCCL för distribuerade arbetsbelastningar, Dynamo och NIXL för disaggregation samt Mission Control för klusterhantering, telemetri och felsökning.
NVIDIAs listade NVLink Fusion‑partner är d-Matrix, AWS, Arm, Intel, Fujitsu, SiFive, Alchip, Astera Labs, GUC, Marvell, MediaTek, Samsung, Cadence, Synopsys, Ayar Labs och Lightmatter, och plattformen stödjer Arm-, x86- och RISC‑V‑CPU‑arkitekturer tillsammans med NVIDIAs GPU:er. NVIDIA benämner den resulterande modellen som en semi‑custom AI‑fabrik, där NVLink Fusion tillhandahåller interconnect, rack‑arkitektur, mjukvara och leveranskedja medan partnern fokuserar på differentierat kisel. Företaget uppgav att deras full‑stack AI‑fabrik‑plattform inkluderar Vera Rubin NVL72, Groq 3 LPX, Vera‑CPU‑racket, Vera BlueField‑4 STX‑lagring och Spectrum‑6 SPX‑Ethernet‑nätverk.
Raptor‑arkitektur och tillgänglighet
Raptor är efterföljaren till d-Matrixs Corsair‑XPU‑plattform, som för närvarande är i produktion, och utökar företagets minnescentrerade arkitektur. Genom vad d-Matrix beskriver som ett unikt 3D‑DRAM‑stackningskoncept kombinerar Raptor ett DRAM‑minneschip med ett SRAM‑beräkningschip i det som företaget kallar ett enda tvåvåningspaket. d-Matrix medgrundare och CTO Sudeep Bhoja presenterade 3D‑DRAM‑tekniken på Hot Chips‑konferensen 2026.
d-Matrix uppgav att de designade Raptor från grunden för integration med NVLink Fusion och NVIDIAs MGX‑rack‑skal‑ekosystem. Företaget förväntar sig att Raptor ska tape‑outas före slutet av 2026 och sade att XPU:n aktivt utvärderas av AI‑hyperscalers och frontier‑labbar; d-Matrix anger att plattformen stöds av mer än 100 patent.
Den första tillgängligheten för Raptor‑XPU:er integrerade i NVIDIAs MGX‑rack förväntas under fjärde kvartalet 2027. d-Matrix demonstrerar tekniken i sin monter på AI Infra Summit.












