Hợp tác
SpaceXAI Đặt CPU Vera của NVIDIA vào Trung Tâm của Việc Xây Dựng Quy Mô Gigawatt

SpaceXAI sẽ triển khai các CPU Vera của NVIDIA để thực hiện các công việc đòi hỏi CPU cao phía sau thế hệ ứng dụng AI có tính đại lý mới của mình, mở rộng việc xây dựng hạ tầng AI phía sau các mô hình Grok mà công ty cho biết đang mở rộng tới quy mô gigawatt công suất tính toán, NVIDIA announced on 24 tháng 8, 2026.
Thỏa thuận này không chỉ giới hạn ở các trung tâm dữ liệu trên mặt đất. SpaceXAI dự định đặt vệ tinh AI Starmind thế hệ đầu tiên của mình trên một hệ thống quy mô rack NVIDIA Vera Rubin NVL72 được tối ưu hoá, mang kiến trúc giống như những nhà máy AI trên mặt đất lên quỹ đạo.
Thông báo này là một câu chuyện về CPU, điều này khiến nó trở nên khác thường trong một ngành công nghiệp đo lường mọi thứ bằng GPU. Các khối tải AI có tính đại lý — các hệ thống thực hiện hành động thay vì chỉ tạo ra câu trả lời — phụ thuộc mạnh vào bộ xử lý thông thường để điều phối công cụ, thực thi mã, xử lý dữ liệu và chạy mô phỏng giữa các lần gọi mô hình. Khi các CPU này chậm, các GPU mà chúng cung cấp sẽ nằm im. Đó chính là nút thắt mà NVIDIA thiết kế Vera để khắc phục.
“AI có tính đại lý đòi hỏi một loại hệ thống tính toán mới — không chỉ được xây dựng để tạo ra câu trả lời, mà còn để thực hiện hành động,” Ian Buck, phó chủ tịch về siêu quy mô và tính toán hiệu năng cao của NVIDIA, nói trong thông báo. “SpaceXAI đang đưa kiến trúc này từ các nhà máy AI quy mô lớn lên biên giới tiếp theo của tính toán trong không gian.”
“Vera cung cấp cho chúng tôi hiệu năng CPU và băng thông bộ nhớ để thực hiện một lượng khổng lồ các công việc điều phối, mã và xử lý dữ liệu trong khi vẫn để GPU làm những gì chúng giỏi nhất,” Mike Nicolls, chủ tịch SpaceXAI, nói trong cùng bản phát hành.
Những Điều Vera Mang Lại Cho Rack
Vera là CPU đầu tiên của NVIDIA được thiết kế từ đầu cho AI có tính đại lý thay vì được điều chỉnh từ các bộ phận máy chủ đa năng. Nó sở hữu 88 lõi Olympus tùy chỉnh với công nghệ Đa luồng Không gian của NVIDIA, tạo ra 176 luồng với tài nguyên lõi được phân chia, và kết hợp chúng với bộ nhớ LPDDR5X băng thông cao cung cấp lên tới 1,2 terabyte mỗi giây. NVIDIA cho biết sự kết hợp này hoàn thành các nhiệm vụ nhanh hơn tới 1,8 lần so với các CPU x86 trong các khối tải AI có tính đại lý, học tăng cường và xử lý dữ liệu, và nhanh hơn tới 80% trong các môi trường sandbox, theo tài liệu sản phẩm của công ty.
Hệ thống bộ nhớ là nơi kiến trúc này tách biệt rõ rệt nhất so với chuẩn x86. Vera sử dụng LPDDR5X trên các mô-đun SOCAMM có thể tháo rời và thay thế tại hiện trường thay vì DDR5 thông thường, mà NVIDIA cho biết cung cấp gấp đôi băng thông và ba lần băng thông trên mỗi lõi so với các CPU x86 hàng đầu, đồng thời tiêu thụ khoảng một nửa năng lượng. Chip hỗ trợ lên tới 1,5 terabyte bộ nhớ mỗi socket, và lớp vải on-die thế hệ thứ hai kết nối tất cả 88 lõi với băng thông cắt đôi 3,4 TB/s, tránh độ trễ giữa các chiplet mà các CPU máy chủ đa die gặp phải. Giao diện NVLink-C2C cung cấp lên tới 1,8 TB/s băng thông đồng nhất giữa các CPU Vera và GPU Rubin của NVIDIA.
Là một nền tảng độc lập, rack CPU Vera tích hợp tới 256 CPU Vera trong một vỏ máy dày đặc, làm mát bằng chất lỏng và hỗ trợ hơn 22.500 môi trường sandbox đồng thời: các container phần mềm cô lập nơi các đại lý chạy mã, gọi công cụ và lặp lại qua các vòng đánh giá. Trong các hệ thống có tính đại lý, mỗi chu kỳ suy luận có thể sinh ra hàng ngàn môi trường như vậy; đội ngũ CPU lưu trữ chúng thực tế đặt mức trần thông lượng cho toàn bộ nhà máy AI.
Phần Mở Rộng Starmind
Khát vọng đưa AI lên quỹ đạo của SpaceXAI mang lại cho việc triển khai một chiều kích thứ hai. Công ty đang phát triển hạ tầng tính toán AI cho không gian, nơi cung cấp năng lượng, quản lý nhiệt, băng thông, độ tin cậy và tích hợp vật lý đặt ra các ràng buộc hoàn toàn khác so với trung tâm dữ liệu trên mặt đất. Vệ tinh AI Starmind thế hệ đầu tiên dự kiến sẽ được xây dựng trên hệ thống Vera Rubin NVL72 được tối ưu hoá (nền tảng quy mô rack kết hợp 72 GPU Rubin với 36 CPU Vera, các card mạng ConnectX-9 SuperNIC và các đơn vị xử lý dữ liệu BlueField-4, được liên kết bằng các bộ chuyển mạch NVLink thế hệ thứ sáu).
NVIDIA và SpaceXAI cho biết họ đang làm việc để điều chỉnh nền tảng này phù hợp với yêu cầu trên quỹ đạo, đồng thời duy trì kiến trúc chung và hệ sinh thái phần mềm thống nhất cho cả triển khai trên mặt đất và không gian.
Một Kiến Trúc, Công Suất Gigawatt
Đối với SpaceXAI, việc áp dụng Vera hợp nhất ngăn xếp tính toán của họ trên một kiến trúc của nhà cung cấp duy nhất khi mở rộng. SpaceXAI đang mở rộng hạ tầng AI phía sau Grok trên nền tảng NVIDIA Vera Rubin khi họ tiến tới công suất tính toán gigawatt, đơn vị đo lường hiện nay cho hạ tầng AI nghiêm trọng. Nền tảng Vera Rubin cung cấp cho họ nền tảng chung cho đào tạo, suy luận và suy đoán, được thiết kế đồng bộ trên tính toán, mạng và phần mềm với các liên kết NVLink, mạng Ethernet Spectrum-X và xử lý dữ liệu BlueField.
Về phía NVIDIA, họ nhận được một triển khai tiêu biểu cho dòng sản phẩm mà họ ra mắt nhằm nắm bắt phần CPU của việc xây dựng AI có tính đại lý. Công ty đã mô tả Vera là CPU đầu tiên được xây dựng cho các đại lý AI, và SpaceXAI gia nhập cùng với Anthropic, OpenAI và Oracle Cloud Infrastructure trong số các triển khai sản xuất sớm mà NVIDIA đã đặt tên cho phần này.
Điểm mấu chốt là kinh tế. NVIDIA quảng cáo Vera Rubin với khả năng cung cấp nhiều token hơn trên mỗi watt và chi phí token thấp hơn so với Blackwell, vì vậy việc điều phối CPU nhanh hơn và giữ cho GPU luôn được sử dụng sẽ trực tiếp chuyển đổi thành nhiều đầu ra hơn trên mỗi watt. Khi SpaceXAI mở rộng tới gigawatt công suất tính toán, hiệu quả này sẽ được nhân lên. NVIDIA đã quảng cáo nền tảng Vera Rubin dựa trên nguyên tắc này: nhiều token hơn trên mỗi watt và chi phí token thấp hơn so với kiến trúc Blackwell trước đây.












