Parteneriate
D-Matrix conectează XPUs Raptor la fabricile AI NVIDIA prin NVLink Fusion

Fabricantul de cipuri pentru inferență AI d-Matrix a anunțat pe 10 septembrie 2026 o colaborare pe mai mulți ani privind foaia de parcurs a produselor cu NVIDIA, care va integra XPUs-urile de inferență de generație următoare Raptor în arhitectura de scară rack MGX a NVIDIA prin NVLink Fusion, cu disponibilitatea inițială integrată în rack așteptată în al patrulea trimestru al anului 2027.
d-Matrix a declarat că acordul oferă XPUs-urilor sale acces în ecosistemul de fabrici AI al NVIDIA. Elementul său central este un sistem la nivel de rack activat prin NVLink Fusion, pe care d-Matrix susține că va permite laboratoarelor AI, hyperscaler-elor și neocloud-urilor să ofere servicii premium de tip token cu latență ultra‑scăzută. Cofondatorul și CEO-ul d-Matrix, Sid Sheth, a descris colaborarea ca un moment definitoriu pentru companie, afirmând că clienții vor putea implementa XPUs-urile de inferență alături de platforma larg disponibilă de fabrică AI NVIDIA.
NVIDIA a declarat într-un post pe blog publicat pe 10 septembrie 2026 că d-Matrix va folosi NVLink Fusion pentru a conecta XPUs-urile Raptor la platforma de infrastructură AI a NVIDIA, adăugând d-Matrix pe lista partenerilor din ecosistemul NVLink Fusion. „Cererea pentru inferență este în creștere, dar capitalul, timpul și energia rămân limitate”, a spus Sheth în timpul unei conferințe de presă, potrivit NVIDIA. El a menționat că NVLink Fusion și MGX permit d-Matrix să integreze XPUs-urile Raptor într-o arhitectură răcită lichid, larg implementată, reducând timpul și riscul de a aduce siliconul de inferență la o implementare la scară largă.
În anunțul d-Matrix, fondatorul și CEO-ul NVIDIA, Jensen Huang, a declarat: „NVLink Fusion permite partenerilor să integreze silicon personalizat în ecosistemul profund al NVIDIA de NVLink, ambalare avansată, sisteme la scară rack și tehnologii de rețea.” Huang a adăugat că, având infrastructura AI NVIDIA care rulează în cloud și în centre de date on‑premise la nivel global, NVLink Fusion oferă partenerilor precum d-Matrix o cale de integrare cu platformele de calcul NVIDIA și extinde alegerea acceleratorilor pentru clienții care construiesc noi fabrici AI.
Integrarea în Rack și Inferența Desagregată
Conform foaiei de parcurs, d-Matrix va colabora cu NVIDIA pentru a încorpora XPUs-urile sale de inferență de generație următoare, începând cu Raptor, direct în cel mai recent design de arhitectură de referință rack al NVIDIA, care include procesoare NVIDIA Vera, switch‑uri NVLink, DPUs BlueField‑4, SuperNIC‑uri ConnectX‑9 și rețea Ethernet Spectrum‑X. Rack‑ul d-Matrix, activat prin platforma MGX, va utiliza tăvi modulare fără cabluri construite cu ecosistemul și lanțul de aprovizionare MGX al NVIDIA.
d-Matrix colaborează, de asemenea, cu Astera Labs, un furnizor de conectivitate în ecosistemul NVLink Fusion, pentru a oferi conectivitate personalizată pentru fluxuri de date cu debit mare în întregul sistem. CEO‑ul Astera Labs, Jitendra Mohan, a declarat că parteneriatul dintre companii aduce conectivitate special concepută, cu debit mare, pentru inferență AI cu latență scăzută în ecosistemul NVLink Fusion.
Conform NVIDIA, d-Matrix intenționează să conecteze XPUs-urile sale într-un singur domeniu de scalare cu bandă largă și latență scăzută folosind NVLink, iar acele rack‑uri sunt proiectate să funcționeze alături de sistemele NVIDIA bazate pe GPU, inclusiv Vera Rubin NVL72, în implementări de inferență desagregată.
d-Matrix a afirmat că, prin desagregarea heterogenă, operatorii pot împărți sarcinile de lucru între XPUs-urile Raptor și sistemele Vera Rubin pentru a optimiza fiecare fază a inferenței. Pentru programarea AI, pe care compania a descris-o ca una dintre cele mai populare aplicații desagregate în prezent, etapa de preumplere, intensivă din punct de vedere al calculului, rulează pe GPU‑uri, în timp ce etapa de decodare, sensibilă la latență, rulează pe XPUs. Compania a precizat că sistemul de rack este conceput pentru aplicații sensibile la latență, cum ar fi asistenții de programare AI, chatbot‑urile în timp real și agenții vocali, unde clienții sunt dispuși să plătească un premiu pentru viteză.
Ce oferă NVLink Fusion
NVIDIA descrie NVLink Fusion ca platforma sa pentru integrarea XPUs și CPU‑uri personalizate de la terți cu rețea de scalare NVLink, arhitectura de rack MGX și platforma completă de fabrică AI care acoperă calcul, rețea, stocare, securitate, alimentare, răcire și software. NVIDIA raportează că platforma oferă o latență XPU‑la‑XPU de trei ori mai mică decât Ethernetul standard, rate de pachete de zece ori mai mari și o lățime de bandă totală de 3 TB/s per XPU prin NVLink de generația a șasea.
Într-un rezumat al platformei publicat pe 24 august 2026, NVIDIA a afirmat că NVLink de generația a șasea furnizează rețea cu bandă largă și latență scăzută pe un domeniu de 72 de XPUs, iar NVLink‑C2C, care conectează XPUs la procesoarele NVIDIA Vera sau alte procesoare din ecosistem, oferă până la de șase ori eficiența energetică a unei interfețe PCIe. Rezumatul a precizat că NVLink Fusion se aliniază cu arhitectura de referință DSX a NVIDIA, care co‑proiectează clădiri, alimentare, răcire, calcul și rețea pentru fabrici AI, și că NVIDIA Omniverse DSX AI Factory Blueprint furnizează un „digital twin” și un design de referință deschis pentru facilități la scară gigawatt. NVIDIA enumeră, de asemenea, software‑ul de suport care include NCCL pentru sarcini distribuite, Dynamo și NIXL pentru desagregare și Mission Control pentru gestionarea clusterelor, telemetrie și depanare.
Partenerii NVLink Fusion enumerați de NVIDIA sunt d-Matrix, AWS, Arm, Intel, Fujitsu, SiFive, Alchip, Astera Labs, GUC, Marvell, MediaTek, Samsung, Cadence, Synopsys, Ayar Labs și Lightmatter, iar platforma suportă arhitecturile CPU Arm, x86 și RISC‑V alături de GPU‑urile NVIDIA. NVIDIA numește modelul rezultat o fabrică AI semi‑personalizată, în care NVLink Fusion furnizează interconectarea, arhitectura de rack, software‑ul și lanțul de aprovizionare, în timp ce partenerul se concentrează pe siliconul diferențiat. Compania a declarat că platforma sa AI full‑stack include Vera Rubin NVL72, Groq 3 LPX, rack‑ul CPU Vera, stocarea Vera BlueField‑4 STX și rețeaua Ethernet Spectrum‑6 SPX.
Arhitectura Raptor și Disponibilitatea
Raptor este succesorul platformei Corsair XPU a d-Matrix, aflată în prezent în producție, și extinde arhitectura companiei centrată pe memorie. Prin ceea ce d-Matrix descrie ca o abordare unică de stivuire 3D DRAM, Raptor combină un cip de memorie DRAM cu un cip de calcul SRAM într-un singur pachet cu două niveluri, așa cum compania îl numește. Cofondatorul și CTO-ul d-Matrix, Sudeep Bhoja, a prezentat tehnologia 3D DRAM la conferința Hot Chips 2026.
d-Matrix a declarat că a proiectat Raptor de la zero pentru integrarea cu NVLink Fusion și ecosistemul de scară rack NVIDIA MGX. Compania se așteaptă ca Raptor să fie finalizat (tape‑out) înainte de sfârșitul anului 2026 și a precizat că XPU‑ul este evaluat activ la hyperscaler‑ele AI și la laboratoarele de frontieră; d-Matrix afirmă că platforma este susținută de peste 100 de brevete.
Disponibilitatea inițială a XPUs‑urilor Raptor integrate în rack‑ul NVIDIA MGX este așteptată în al patrulea trimestru al anului 2027. d-Matrix demonstrează tehnologia la standul său de la AI Infra Summit.












