Партнёрства
D‑Matrix подключает Raptor XPU к AI‑фабрикам NVIDIA через NVLink Fusion

Производитель чипов для AI‑вывода d‑Matrix объявил 10 сентября 2026 года о многолетнем сотрудничестве с NVIDIA по дорожной карте продуктов, в рамках которого его следующего поколения инференс‑XPUs Raptor будут интегрированы в масштабируемую архитектуру стоек MGX от NVIDIA через NVLink Fusion, а первая интегрированная поставка ожидается в четвертом квартале 2027 года.
d‑Matrix заявила, что соглашение открывает её XPUs доступ к экосистеме AI‑фабрик NVIDIA. В центре внимания — система уровня стойки с поддержкой NVLink Fusion, которая, по словам d‑Matrix, позволит лабораториям ИИ, гиперскейлерам и неоклауд‑провайдерам предлагать премиальные токен‑сервисы с ультранизкой задержкой. Со‑основатель и генеральный директор d‑Matrix Сид Шет охарактеризовал сотрудничество как ключевой момент для компании, отметив, что клиенты смогут развертывать её инференс‑XPUs рядом с широко доступной платформой AI‑фабрик NVIDIA.
В блоге NVIDIA, опубликованном 10 сентября 2026 года, компания заявила, что d‑Matrix будет использовать NVLink Fusion для подключения своих Raptor XPUs к платформе AI‑инфраструктуры NVIDIA, добавив d‑Matrix в список партнёров экосистемы NVLink Fusion. «Спрос на инференс стремительно растёт, но капиталы, время и энергия остаются ограниченными», — сказал Шет на пресс‑брифинге, согласно NVIDIA. Он отметил, что NVLink Fusion и MGX позволяют d‑Matrix интегрировать Raptor XPUs в широко развернутую жидкостно‑охлаждаемую архитектуру, сокращая время и риски вывода её инференс‑силы в крупномасштабные развертывания.
В объявлении d‑Matrix основатель и генеральный директор NVIDIA Дженсен Хуанг сказал: «NVLink Fusion позволяет партнёрам интегрировать пользовательские кристаллы в обширную экосистему NVIDIA, включающую NVLink, передовые упаковочные технологии, масштабируемые системы и сетевые технологии». Хуанг добавил, что при работе AI‑инфраструктуры NVIDIA в облаках и локальных дата‑центрах по всему миру NVLink Fusion предоставляет партнёрам, таким как d‑Matrix, путь к интеграции с вычислительными платформами NVIDIA и расширяет выбор ускорителей для клиентов, создающих новые AI‑фабрики.
Интеграция в стойку и дезагрегированный инференс
В рамках дорожной карты d‑Matrix будет сотрудничать с NVIDIA для непосредственного включения своих инференс‑XPUs следующего поколения, начиная с Raptor, в новейший референс‑дизайн стойки NVIDIA, который включает процессоры NVIDIA Vera, коммутаторы NVLink, DPU BlueField‑4, SuperNIC ConnectX‑9 и Ethernet‑сети Spectrum‑X. Стойка d‑Matrix, поддерживаемая платформой MGX, будет использовать модульные лотки без кабелей, разработанные на базе экосистемы и цепочки поставок MGX от NVIDIA.
d‑Matrix также сотрудничает с Astera Labs, поставщиком соединений в экосистеме NVLink Fusion, для обеспечения кастомных соединений с высокой пропускной способностью по всей системе. Генеральный директор Astera Labs Джитендра Мохан отметил, что партнёрство компаний предоставляет специально разработанные высокопропускные соединения для низколатентного AI‑инференса в экосистеме NVLink Fusion.
Согласно NVIDIA, d‑Matrix планирует соединять свои XPUs в единой высокоскоростной, низколатентной масштабируемой доменной сети с использованием NVLink, а такие стойки спроектированы для работы рядом с GPU‑системами NVIDIA, включая Vera Rubin NVL72, в дезагрегированных инференс‑развёртываниях.
d‑Matrix заявила, что при гетерогенной дезагрегации операторы могут распределять нагрузки между Raptor XPUs и системами Vera Rubin для оптимизации каждой фазы инференса. Для AI‑кодинга, который компания назвала одним из самых популярных текущих дезагрегированных приложений, вычислительно‑интенсивный этап предварительного заполнения выполняется на GPU, тогда как этап декодирования, чувствительный к задержке, работает на её XPUs. Компания отметила, что система стойки предназначена для приложений с высокой чувствительностью к задержке, таких как помощники по AI‑кодингу, чат‑боты в реальном времени и голосовые агенты, где клиенты готовы платить премию за скорость.
Что предоставляет NVLink Fusion
NVIDIA описывает NVLink Fusion как платформу для интеграции сторонних кастомных XPUs и CPU с масштабируемой сетью NVLink, архитектурой стоек MGX и полной платформой AI‑фабрик, охватывающей вычисления, сеть, хранение, безопасность, питание, охлаждение и программное обеспечение. NVIDIA сообщает, что платформа обеспечивает в 3 раза более низкую задержку XPU‑к‑XPU по сравнению со стандартным Ethernet, в 10 раз выше скорость передачи пакетов и 3 ТБ/с на XPU пропускную способность all‑to‑all через шестое поколение NVLink.
В обзоре платформы опубликованном 24 августа 2026 года NVIDIA заявила, что шестое поколение NVLink обеспечивает высокоскоростную, низколатентную сеть в домене из 72 XPU, а NVLink‑C2C, соединяющий XPUs с процессорами NVIDIA Vera или другими процессорами экосистемы, достигает до 6‑кратной энергоэффективности по сравнению с интерфейсом PCIe. В обзоре отмечено, что NVLink Fusion согласуется с референс‑архитектурой DSX от NVIDIA, в которой совместно разрабатываются здания, питание, охлаждение, вычисления и сеть для AI‑фабрик, а «NVIDIA Omniverse DSX AI Factory Blueprint» предоставляет цифровой двойник и открытый референс‑дизайн для объектов масштаба в гига‑ватт. NVIDIA также перечисляет поддерживаемое программное обеспечение, включая NCCL для распределённых нагрузок, Dynamo и NIXL для дезагрегации, а также Mission Control для управления кластерами, телеметрии и отладки.
В числе партнёров NVLink Fusion, указанных NVIDIA, находятся d‑Matrix, AWS, Arm, Intel, Fujitsu, SiFive, Alchip, Astera Labs, GUC, Marvell, MediaTek, Samsung, Cadence, Synopsys, Ayar Labs и Lightmatter; платформа поддерживает архитектуры процессоров Arm, x86 и RISC‑V наряду с GPU NVIDIA. NVIDIA называет получившуюся модель «полу‑кастомной AI‑фабрикой», где NVLink Fusion обеспечивает соединение, архитектуру стоек, программное обеспечение и цепочку поставок, а партнёр сосредотачивается на дифференцированном кремнии. Компания заявила, что её полно‑стековая платформа AI‑фабрик включает Vera Rubin NVL72, Groq 3 LPX, стойку процессоров Vera, хранилище Vera BlueField‑4 STX и Ethernet‑сеть Spectrum‑6 SPX.
Архитектура Raptor и доступность
Raptor — это продолжение платформы XPU Corsair от d‑Matrix, которая в настоящее время находится в производстве, и расширяет память‑центрированную архитектуру компании. По описанию d‑Matrix, Raptor использует уникальный подход к 3‑D стэкингу DRAM, объединяя DRAM‑чип памяти с SRAM‑чипом вычислений в том, что компания называет единым двухуровневым пакетом. Со‑основатель и технический директор d‑Matrix Судип Бхожа представил технологию 3‑D DRAM на конференции Hot Chips 2026 года.
d‑Matrix заявила, что разработала Raptor с нуля для интеграции с NVLink Fusion и масштабируемой экосистемой стоек NVIDIA MGX. Компания ожидает, что Raptor будет готов к массе перед окончанием 2026 года, и отметила, что XPU активно оценивается гиперскейлерами AI и передовыми лабораториями; d‑Matrix сообщает, что платформа поддерживается более чем 100 патентами.
Первая доступность Raptor XPUs, интегрированных в стойку NVIDIA MGX, ожидается в четвертом квартале 2027 года. d‑Matrix демонстрирует технологию на своём стенде на AI Infra Summit.












