Hợp tác

D-Matrix Kết Nối Raptor XPUs với Các Nhà Máy AI NVIDIA qua NVLink Fusion

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Nhà sản xuất chip suy luận AI d-Matrix công bố vào ngày 10 tháng 9 năm 2026 một hợp tác lộ trình sản phẩm đa năm với NVIDIA, sẽ tích hợp các XPU suy luận thế hệ mới Raptor vào kiến trúc quy mô rack MGX của NVIDIA thông qua NVLink Fusion, với dự kiến khả dụng tích hợp rack ban đầu vào quý 4 năm 2027.

d-Matrix cho biết thỏa thuận này mang lại cho các XPU của mình cơ hội tham gia vào hệ sinh thái nhà máy AI của NVIDIA. Trụ cột chính là một hệ thống cấp độ rack được hỗ trợ bởi NVLink Fusion, mà d-Matrix cho rằng sẽ cho phép các phòng thí nghiệm AI, các nhà cung cấp dịch vụ quy mô lớn và các neocloud cung cấp dịch vụ token hạng cao với độ trễ cực thấp. Đồng sáng lập và CEO của d-Matrix, Sid Sheth, mô tả sự hợp tác này là một bước ngoặt quan trọng đối với công ty, nói rằng khách hàng sẽ có thể triển khai các XPU suy luận của mình cùng với nền tảng nhà máy AI rộng rãi của NVIDIA.

NVIDIA cho biết trong một bài đăng blog được xuất bản ngày 10 tháng 9 năm 2026 rằng d-Matrix sẽ sử dụng NVLink Fusion để kết nối các Raptor XPU của mình với nền tảng hạ tầng AI của NVIDIA, đồng thời đưa d-Matrix vào danh sách các đối tác hệ sinh thái NVLink Fusion. “Nhu cầu về suy luận đang tăng mạnh, nhưng vốn, thời gian và năng lượng vẫn có giới hạn,” Sheth nói trong một buổi họp báo, theo NVIDIA. Ông cho biết NVLink Fusion và MGX cho phép d-Matrix tích hợp các Raptor XPU vào một kiến trúc được triển khai rộng rãi, làm mát bằng chất lỏng, giảm thời gian và rủi ro khi đưa silicon suy luận của mình vào triển khai quy mô lớn.

Trong thông báo của d-Matrix, nhà sáng lập và CEO của NVIDIA, Jensen Huang, đã nói: “NVLink Fusion cho phép các đối tác tích hợp silicon tùy chỉnh với hệ sinh thái sâu rộng của NVIDIA bao gồm NVLink, đóng gói tiên tiến, hệ thống quy mô rack và công nghệ mạng.” Huang cho biết, với hạ tầng AI của NVIDIA hoạt động trên đám mây và các trung tâm dữ liệu tại chỗ trên toàn thế giới, NVLink Fusion cung cấp cho các đối tác như d-Matrix một lộ trình để tích hợp với các nền tảng tính toán của NVIDIA và mở rộng lựa chọn bộ tăng tốc cho khách hàng xây dựng các nhà máy AI mới.

Tích Hợp Rack và Suy Luận Phân Tán

Theo lộ trình, d-Matrix sẽ hợp tác với NVIDIA để tích hợp các XPU suy luận thế hệ mới, bắt đầu với Raptor, trực tiếp vào thiết kế kiến trúc tham chiếu rack mới nhất của NVIDIA, bao gồm CPU NVIDIA Vera, các switch NVLink, DPU BlueField-4, SuperNIC ConnectX-9 và mạng Ethernet Spectrum-X. Rack của d-Matrix, được hỗ trợ bởi nền tảng MGX, sẽ sử dụng các khay mô-đun không dây cáp được xây dựng dựa trên hệ sinh thái và chuỗi cung ứng MGX của NVIDIA.

d-Matrix cũng đang hợp tác với Astera Labs, một nhà cung cấp kết nối trong hệ sinh thái NVLink Fusion, để cung cấp kết nối tùy chỉnh cho luồng dữ liệu truyền tải cao khắp hệ thống. Giám đốc điều hành của Astera Labs, Jitendra Mohan, cho biết sự hợp tác giữa các công ty mang lại kết nối được thiết kế riêng, truyền tải cao cho suy luận AI độ trễ thấp trong hệ sinh thái NVLink Fusion.

Theo NVIDIA, d-Matrix dự định kết nối các XPU của mình trong một miền mở rộng băng thông cao, độ trễ thấp duy nhất bằng NVLink, và các rack này được thiết kế để hoạt động bên cạnh các hệ thống NVIDIA dựa trên GPU, bao gồm Vera Rubin NVL72, trong các triển khai suy luận phân tán.

d-Matrix cho biết với việc phân tán hỗn hợp, các nhà vận hành có thể chia tải công việc giữa Raptor XPU và hệ thống Vera Rubin để tối ưu hoá từng giai đoạn của suy luận. Đối với lập trình AI, mà công ty mô tả là một trong những ứng dụng phân tán hiện nay phổ biến nhất, giai đoạn tiền nạp tính toán nặng chạy trên GPU trong khi giai đoạn giải mã nhạy cảm với độ trễ chạy trên các XPU của mình. Công ty cho biết hệ thống rack được thiết kế cho các ứng dụng nhạy cảm với độ trễ như trợ lý lập trình AI, chatbot thời gian thực và trợ lý giọng nói, nơi khách hàng sẵn sàng trả phí cao hơn để có tốc độ nhanh hơn.

NVLink Fusion Cung Cấp Gì

NVIDIA mô tả NVLink Fusion là nền tảng của mình để tích hợp các XPU và CPU tùy chỉnh của bên thứ ba với mạng lưới mở rộng NVLink, kiến trúc rack MGX và toàn bộ nền tảng nhà máy AI bao gồm tính toán, mạng, lưu trữ, bảo mật, năng lượng, làm mát và phần mềm. NVIDIA báo cáo rằng nền tảng này cung cấp độ trễ XPU‑to‑XPU thấp hơn 3 lần so với Ethernet thông thường, tốc độ gói tin cao hơn 10 lần và băng thông all‑to‑all đạt 3 TB/s cho mỗi XPU thông qua NVLink thế hệ thứ sáu.

Trong một tổng quan nền tảng được xuất bản ngày 24 tháng 8 năm 2026, NVIDIA cho biết NVLink thế hệ thứ sáu cung cấp mạng băng thông cao, độ trễ thấp trên một miền 72‑XPU, và NVLink‑C2C, kết nối các XPU với CPU NVIDIA Vera hoặc các CPU khác trong hệ sinh thái, mang lại hiệu suất năng lượng lên tới 6 lần so với giao diện PCIe. Tổng quan này cho biết NVLink Fusion phù hợp với kiến trúc tham chiếu DSX của NVIDIA, vốn đồng thiết kế tòa nhà, năng lượng, làm mát, tính toán và mạng cho các nhà máy AI, và rằng NVIDIA Omniverse DSX AI Factory Blueprint cung cấp bản sao kỹ thuật số và thiết kế tham chiếu mở cho các cơ sở quy mô gigawatt. NVIDIA cũng liệt kê phần mềm hỗ trợ bao gồm NCCL cho tải công việc phân tán, Dynamo và NIXL cho phân tán, và Mission Control cho quản lý cụm, thu thập dữ liệu và gỡ lỗi.

Các đối tác NVLink Fusion được NVIDIA liệt kê bao gồm d-Matrix, AWS, Arm, Intel, Fujitsu, SiFive, Alchip, Astera Labs, GUC, Marvell, MediaTek, Samsung, Cadence, Synopsys, Ayar Labs và Lightmatter, và nền tảng này hỗ trợ các kiến trúc CPU Arm, x86 và RISC‑V cùng với GPU của NVIDIA. NVIDIA gọi mô hình thu được là một nhà máy AI bán tùy chỉnh, trong đó NVLink Fusion cung cấp kết nối, kiến trúc rack, phần mềm và chuỗi cung ứng, trong khi đối tác tập trung vào silicon có tính phân biệt. Công ty cho biết nền tảng nhà máy AI toàn stack của mình bao gồm Vera Rubin NVL72, Groq 3 LPX, rack CPU Vera, lưu trữ Vera BlueField‑4 STX và mạng Ethernet Spectrum‑6 SPX.

Kiến Trúc Raptor và Tình Trạng Sẵn Có

Raptor là thế hệ tiếp nối của nền tảng XPU Corsair của d-Matrix, hiện đang trong giai đoạn sản xuất, và mở rộng kiến trúc tập trung vào bộ nhớ của công ty. Thông qua cách tiếp cận xếp chồng 3D DRAM đầu tiên như d-Matrix mô tả, Raptor kết hợp một chip bộ nhớ DRAM với một chip tính toán SRAM trong một gói hai tầng duy nhất mà công ty gọi là single two-story package. Đồng sáng lập và CTO của d-Matrix, Sudeep Bhoja, đã giới thiệu công nghệ 3D DRAM tại hội nghị Hot Chips 2026.

d-Matrix cho biết đã thiết kế Raptor từ đầu để tích hợp với NVLink Fusion và hệ sinh thái rack‑scale NVIDIA MGX. Công ty dự kiến Raptor sẽ được tape‑out trước cuối năm 2026 và cho biết XPU đang được các nhà cung cấp dịch vụ AI quy mô lớn và các phòng thí nghiệm tiên tiến đánh giá tích cực; d-Matrix khẳng định nền tảng này được hỗ trợ bởi hơn 100 bằng sáng chế.

Khả năng sẵn có ban đầu của các Raptor XPU được tích hợp vào rack NVIDIA MGX dự kiến sẽ có vào quý 4 năm 2027. d-Matrix đang trình diễn công nghệ này tại gian hàng của mình tại AI Infra Summit.

Theo Nash là một chuyên gia được tạo bởi trí tuệ nhân tạo tại Unite.AI, chuyên về cơ sở hạ tầng trí tuệ nhân tạo, tính toán và các hệ thống phần cứng hỗ trợ trí tuệ nhân tạo hiện đại. Công việc của ông tập trung vào các nền tảng kỹ thuật đằng sau các công việc trí tuệ nhân tạo quy mô lớn, bao gồm trung tâm dữ liệu, tăng tốc, mạng và các phần mềm liên kết chúng lại với nhau.
Với quan điểm phân tích và kỹ thuật, Theo nghiên cứu cách các tiến bộ trong GPU, silicon tùy chỉnh, kiến trúc bộ nhớ và hệ thống phân tán cho phép tạo ra các mô hình trí tuệ nhân tạo mới. Ông đặc biệt chú ý đến việc trao đổi hiệu suất, hiệu quả năng lượng, khả năng mở rộng và các hạn chế thực tế định hình việc triển khai cơ sở hạ tầng trí tuệ nhân tạo trong thế giới thực.
Các bài viết được viết bởi Theo Nash được tạo bởi trí tuệ nhân tạo và được nhóm biên tập của Unite.AI xem xét để đảm bảo độ chính xác kỹ thuật, sự rõ ràng và phạm vi bao quát có trách nhiệm về tính toán trí tuệ nhân tạo đang phát triển nhanh chóng.