合作伙伴
D‑Matrix 将 Raptor XPU 通过 NVLink Fusion 连接至 NVIDIA AI 工厂

AI 推理芯片制造商 d‑Matrix 于 2026 年 9 月 10 日宣布,与 NVIDIA 开展为期多年的产品路线图合作,将其下一代 Raptor 推理 XPU 通过 NVLink Fusion 集成到 NVIDIA 的 MGX 机架规模架构中,预计首批机架集成将在 2027 年第四季度推出。
d‑Matrix 表示,该协议为其 XPU 打开了进入 NVIDIA AI 工厂生态系统的大门。其核心是一套支持 NVLink Fusion 的机架级系统,d‑Matrix 称该系统将使 AI 实验室、超大规模云服务商和新型云平台能够以超低延迟提供高端代币服务。d‑Matrix 联合创始人兼 CEO Sid Sheth 将此次合作形容为公司发展的决定性时刻,并表示客户将能够在广泛可用的 NVIDIA AI 工厂平台上部署其推理 XPU。
NVIDIA 在 2026 年 9 月 10 日发布的博客文章中表示,d‑Matrix 将使用 NVLink Fusion 将其 Raptor XPU 连接到 NVIDIA 的 AI 基础设施平台,使 d‑Matrix 成为 NVLink Fusion 生态系统合作伙伴名单中的一员。NVIDIA 称,Sheth 在新闻发布会期间表示:“推理需求正迅速增长,但资本、时间和能源仍然有限。”他还指出,NVLink Fusion 与 MGX 使 d‑Matrix 能够将 Raptor XPU 集成到广泛部署的液冷架构中,从而缩短将其推理硅片大规模投产的时间并降低风险。
在d‑Matrix 公告中,NVIDIA 创始人兼 CEO Jensen Huang 表示: “NVLink Fusion 使合作伙伴能够将定制硅片与 NVIDIA 深厚的 NVLink、先进封装、机架规模系统和网络技术生态系统集成。”Huang 补充说,随着 NVIDIA AI 基础设施在全球云端和本地数据中心的运行,NVLink Fusion 为 d‑Matrix 等合作伙伴提供了与 NVIDIA 计算平台集成的路径,并为构建新 AI 工厂的客户扩大了加速器的选择范围。
机架集成与分散式推理
根据路线图,d‑Matrix 将与 NVIDIA 合作,将其下一代推理 XPU(从 Raptor 开始)直接纳入 NVIDIA 最新的机架参考架构设计,该设计包括 NVIDIA Vera CPU、NVLink 交换机、BlueField‑4 DPU、ConnectX‑9 SuperNIC 以及 Spectrum‑X 以太网网络。由 MGX 平台支持的 d‑Matrix 机架将使用基于 NVIDIA MGX 生态系统和供应链构建的模块化无线缆托盘。
d‑Matrix 还与 NVLink Fusion 生态系统中的连接提供商 Astera Labs 合作,为系统内部的高吞吐数据流提供定制连接。Astera Labs CEO Jitendra Mohan 表示,两家公司合作为 NVLink Fusion 生态系统带来了专为低延迟 AI 推理设计的高吞吐连接方案。
据 NVIDIA 称,d‑Matrix 计划使用 NVLink 在单一高带宽、低延迟的规模化域中连接其 XPU,这些机架设计用于在分散式推理部署中与基于 GPU 的 NVIDIA 系统(包括 Vera Rubin NVL72)并行运行。
d‑Matrix 表示,通过异构分散,运营商可以在 Raptor XPU 与 Vera Rubin 系统之间拆分工作负载,以优化推理的每个阶段。对于 AI 编码——公司称其为当前最受欢迎的分散式应用之一——计算密集的预填充阶段在 GPU 上运行,而对延迟敏感的解码阶段则在其 XPU 上运行。公司称,该机架系统专为对延迟敏感的应用设计,如 AI 编码助手、实时聊天机器人和语音代理,并指出客户愿意为更快的速度支付溢价。
NVLink Fusion 能提供的功能
NVIDIA 将 NVLink Fusion 描述为其平台,用于将第三方定制 XPU 和 CPU 与 NVLink 规模化网络、MGX 机架架构以及涵盖计算、网络、存储、安全、供电、散热和软件的完整 AI 工厂平台集成。NVIDIA 报告称,该平台相较于现成以太网实现了 3 倍更低的 XPU 对 XPU 延迟、10 倍更高的包速率,以及通过第六代 NVLink 实现每个 XPU 3 TB/s 的全互联带宽。
在2026 年 8 月 24 日发布的平台概览中,NVIDIA 表示,第六代 NVLink 在 72 XPU 域内提供高带宽、低延迟的网络,并且将 XPU 与 NVIDIA Vera CPU 或其他生态系统 CPU 连接的 NVLink‑C2C 相比 PCIe 接口可实现最高 6 倍的能效。概览指出,NVLink Fusion 与 NVIDIA 的 DSX 参考架构保持一致,该架构为 AI 工厂共同设计建筑、电力、散热、计算和网络,并且 NVIDIA Omniverse DSX AI Factory Blueprint 为千兆瓦级设施提供数字孪生和开放参考设计。NVIDIA 还列出了包括 NCCL(用于分布式工作负载)、Dynamo 和 NIXL(用于分散)以及 Mission Control(用于集群管理、遥测和调试)的支持软件。
NVIDIA 列出的 NVLink Fusion 合作伙伴包括 d‑Matrix、AWS、Arm、Intel、富士通、SiFive、Alchip、Astera Labs、GUC、Marvell、联发科、三星、Cadence、Synopsys、Ayar Labs 和 Lightmatter,平台同时支持 Arm、x86 和 RISC‑V CPU 架构以及 NVIDIA GPU。NVIDIA 将这种模式称为半定制 AI 工厂,其中 NVLink Fusion 提供互连、机架架构、软件和供应链,而合作伙伴专注于差异化硅片。公司表示,其全栈 AI 工厂平台包括 Vera Rubin NVL72、Groq 3 LPX、Vera CPU 机架、Vera BlueField‑4 STX 存储以及 Spectrum‑6 SPX 以太网网络。
Raptor 架构与可用性
Raptor 是 d‑Matrix 当前量产的 Corsair XPU 平台的后续产品,进一步扩展了公司以内存为中心的架构。d‑Matrix 称其采用了首创的 3D DRAM 堆叠技术,将 DRAM 存储芯片与 SRAM 计算芯片组合在公司所谓的单一双层封装中。d‑Matrix 联合创始人兼 CTO Sudeep Bhoja 在 2026 年 Hot Chips 大会上预览了该 3D DRAM 技术。
d‑Matrix 表示,Raptor 从零开始专为与 NVLink Fusion 以及 NVIDIA MGX 机架规模生态系统的集成而设计。公司预计 Raptor 将在 2026 年底前完成掩模版图,并称该 XPU 正在 AI 超大规模云服务商和前沿实验室中积极评估;d‑Matrix 透露平台拥有超过 100 项专利支持。
Raptor XPU 集成到 NVIDIA MGX 机架的首批可用性预计将在 2027 年第四季度推出。d‑Matrix 正在 AI Infra Summit 展位上展示该技术。












