파트너십
D-Matrix, NVLink Fusion을 통해 Raptor XPUs를 NVIDIA AI 팩토리와 연결

AI 추론 칩 제조업체 d-Matrix는 2026년 9월 10일, NVIDIA와 다년간 제품 로드맵 협업을 발표했으며, 이를 통해 차세대 Raptor 추론 XPU를 NVLink Fusion을 통해 NVIDIA의 MGX 랙 규모 아키텍처에 통합할 예정이며, 초기 랙 통합 가용성은 2027년 4분기에 기대된다.
d-Matrix는 이번 협약을 통해 자사의 XPU가 NVIDIA AI 팩토리 생태계에 진입하게 된다고 밝혔다. 핵심은 NVLink Fusion을 지원하는 랙 수준 시스템으로, d-Matrix는 이를 통해 AI 연구소, 하이퍼스케일 기업 및 네오클라우드가 초저지연 프리미엄 토큰 서비스를 제공할 수 있게 될 것이라고 말했다. d-Matrix 공동창업자이자 CEO인 Sid Sheth는 이번 협업을 회사의 결정적 순간이라고 설명하며, 고객이 널리 제공되는 NVIDIA AI 팩토리 플랫폼과 함께 추론 XPU를 배치할 수 있게 될 것이라고 전했다.
NVIDIA는 2026년 9월 10일에 게시된 블로그 게시물에서 d-Matrix가 NVLink Fusion을 사용해 Raptor XPU를 NVIDIA AI 인프라 플랫폼에 연결할 것이며, 이를 통해 d-Matrix가 NVLink Fusion 생태계 파트너 명단에 추가된다고 밝혔다. NVIDIA에 따르면, Sheth는 기자 회견에서 “추론에 대한 수요는 급증하고 있지만 자본, 시간, 에너지는 한정되어 있다”고 말했다. 그는 NVLink Fusion과 MGX가 d-Matrix가 Raptor XPU를 널리 배포된 액체 냉각 아키텍처에 통합하게 하여, 추론 실리콘을 대규모로 배포하는 데 필요한 시간과 위험을 줄여준다고 설명했다.
d-Matrix 발표에서 NVIDIA 창립자이자 CEO인 Jensen Huang은: “NVLink Fusion은 파트너가 맞춤형 실리콘을 NVIDIA의 광범위한 NVLink, 고급 패키징, 랙 규모 시스템 및 네트워킹 기술 생태계와 통합할 수 있게 해준다”고 말했다. Huang은 또한 전 세계 클라우드와 온프레미스 데이터 센터에서 운영되는 NVIDIA AI 인프라와 함께, NVLink Fusion이 d-Matrix와 같은 파트너에게 NVIDIA 컴퓨트 플랫폼과 통합할 수 있는 경로를 제공하고, 새로운 AI 팩토리를 구축하는 고객에게 가속기 선택 폭을 넓힌다고 덧붙였다.
Rack Integration and Disaggregated Inference
로드맵에 따라 d-Matrix는 NVIDIA와 협력해 차세대 추론 XPU를 Raptor부터 시작해 직접 NVIDIA 최신 랙 레퍼런스 아키텍처 설계에 통합할 예정이다. 이 설계는 NVIDIA Vera CPU, NVLink 스위치, BlueField-4 DPU, ConnectX-9 SuperNIC 및 Spectrum-X 이더넷 네트워킹을 특징으로 한다. MGX 플랫폼으로 지원되는 d-Matrix 랙은 NVIDIA의 MGX 생태계와 공급망으로 구축된 모듈식 무케이블 트레이를 사용할 것이다.
d-Matrix는 NVLink Fusion 생태계의 연결 제공업체인 Astera Labs와도 파트너십을 맺어 시스템 전반에 걸친 고처리량 데이터 흐름을 위한 맞춤형 연결성을 제공한다. Astera Labs CEO인 Jitendra Mohan은 양사의 파트너십이 저지연 AI 추론을 위한 목적에 맞춘 고처리량 연결성을 NVLink Fusion 생태계에 가져온다고 말했다.
NVIDIA에 따르면, d-Matrix는 NVLink를 사용해 단일 고대역폭·저지연 스케일업 도메인에서 XPU를 연결할 계획이며, 이러한 랙은 Vera Rubin NVL72를 포함한 GPU 기반 NVIDIA 시스템 옆에서 동작하도록 설계되어 분산 추론 배포에 활용된다.
d-Matrix는 이기종 분산을 통해 운영자가 Raptor XPU와 Vera Rubin 시스템 간에 워크로드를 분할해 추론 각 단계를 최적화할 수 있다고 밝혔다. 회사가 현재 가장 인기 있는 분산 애플리케이션 중 하나라고 설명한 AI 코딩의 경우, 연산 집약적인 프리필 단계는 GPU에서 실행되고, 지연에 민감한 디코드 단계는 XPU에서 실행된다. 또한 이 랙 시스템은 AI 코딩 어시스턴트, 실시간 챗봇, 음성 에이전트와 같이 지연에 민감한 애플리케이션을 위해 설계되었으며, 고객이 속도에 대해 프리미엄을 지불할 의향이 있다고 전했다.
What NVLink Fusion Provides
NVIDIA는 NVLink Fusion을 제3자 맞춤형 XPU와 CPU를 NVLink 스케일업 네트워킹, MGX 랙 아키텍처 및 컴퓨팅, 네트워킹, 스토리지, 보안, 전원, 냉각, 소프트웨어를 포괄하는 전체 AI 팩토리 플랫폼과 통합하기 위한 플랫폼으로 설명한다. NVIDIA는 이 플랫폼이 일반 이더넷 대비 XPU 간 지연을 3배 낮추고, 패킷 처리량을 10배 높이며, 6세대 NVLink를 통해 XPU당 3TB/s의 전역 대역폭을 제공한다고 보고한다.
2026년 8월 24일에 발표된 플랫폼 개요에서 NVIDIA는 6세대 NVLink가 72 XPU 도메인 전역에 고대역폭·저지연 네트워킹을 제공하며, XPU를 NVIDIA Vera CPU 또는 기타 생태계 CPU와 연결하는 NVLink-C2C가 PCIe 인터페이스 대비 최대 6배의 에너지 효율을 제공한다고 밝혔다. 개요에서는 NVLink Fusion이 AI 팩토리를 위한 건물, 전원, 냉각, 컴퓨팅 및 네트워킹을 공동 설계하는 NVIDIA의 DSX 레퍼런스 아키텍처와 일치한다고 설명했으며, NVIDIA Omniverse DSX AI Factory Blueprint가 기가와트 규모 시설을 위한 디지털 트윈 및 오픈 레퍼런스 디자인을 제공한다고 언급했다. 또한 NVIDIA는 분산 워크로드를 위한 NCCL, 분산을 위한 Dynamo와 NIXL, 클러스터 관리·텔레메트리·디버깅을 위한 Mission Control 등 지원 소프트웨어를 나열했다.
NVIDIA가 발표한 NVLink Fusion 파트너에는 d-Matrix, AWS, Arm, Intel, Fujitsu, SiFive, Alchip, Astera Labs, GUC, Marvell, MediaTek, Samsung, Cadence, Synopsys, Ayar Labs, Lightmatter가 포함되며, 이 플랫폼은 NVIDIA GPU와 함께 Arm, x86, RISC‑V CPU 아키텍처를 지원한다. NVIDIA는 이 모델을 반맞춤형 AI 팩토리라고 부르며, NVLink Fusion이 인터커넥트, 랙 아키텍처, 소프트웨어 및 공급망을 제공하고 파트너는 차별화된 실리콘에 집중한다. 회사는 전체 스택 AI 팩토리 플랫폼에 Vera Rubin NVL72, Groq 3 LPX, Vera CPU 랙, Vera BlueField-4 STX 스토리지, Spectrum-6 SPX 이더넷 네트워킹이 포함된다고 밝혔다.
Raptor Architecture and Availability
Raptor는 현재 생산 중인 d-Matrix의 Corsair XPU 플랫폼의 후속 제품으로, 회사의 메모리 중심 아키텍처를 확장한다. d-Matrix가 최초라고 설명하는 3D DRAM 스태킹 방식을 통해 Raptor는 DRAM 메모리 칩과 SRAM 컴퓨트 칩을 하나의 2층 패키지로 결합한다. d-Matrix 공동창업자이자 CTO인 Sudeep Bhoja는 2026년 Hot Chips 컨퍼런스에서 3D DRAM 기술을 미리 선보였다.
d-Matrix는 Raptor를 NVLink Fusion 및 NVIDIA MGX 랙 규모 생태계와의 통합을 위해 처음부터 설계했다고 밝혔다. 회사는 Raptor가 2026년 말 이전에 테이프아웃될 것으로 예상하며, 이 XPU가 AI 하이퍼스케일러와 최첨단 연구소에서 활발히 평가되고 있다고 전했다. d-Matrix는 이 플랫폼이 100개 이상의 특허로 뒷받침된다고 밝혔다.
NVIDIA MGX 랙에 통합된 Raptor XPU의 초기 가용성은 2027년 4분기에 기대된다. d-Matrix는 AI Infra Summit 부스에서 해당 기술을 시연하고 있다.












