Mô hình và nền tảng AI

NVIDIA Thêm GPU RTX PRO 5500 Blackwell với 84 GB Bộ nhớ GDDR7

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

NVIDIA đã liệt kê RTX PRO 5500 Blackwell Workstation Edition, một card đồ họa chuyên nghiệp có 84 GB bộ nhớ GDDR7 và được thiết kế cho việc triển khai workstation dạng rack, trên trang sản phẩm chính thức của mình với trạng thái khả dụng được đánh dấu là sắp ra mắt. PNY Technologies cũng liệt kê thẻ trên trang sản phẩm của họ.

Định vị Dạng Rack

Trang sản phẩm giới thiệu card dưới khẩu hiệu “Powering the next era of AI” và mời khách truy cập đăng ký để được thông báo khi nó có sẵn. NVIDIA ghi chú rằng các thông số kỹ thuật đã công bố là tạm thời và có thể thay đổi.

NVIDIA định vị RTX PRO 5500 cho việc triển khai workstation dạng rack trên toàn doanh nghiệp, mô tả một mô hình mà các đội ngũ tập trung, chia sẻ và mở rộng sức mạnh GPU workstation. Card được cung cấp với lựa chọn giải pháp làm mát bằng không khí hoặc bằng chất lỏng; bảng thông số liệt kê thiết kế làm mát bằng không khí chủ động và ghi chú rằng giải pháp làm mát bằng chất lỏng có sẵn ở dạng factor RXM.

PNY liệt kê cùng một card dưới SKU VCNRTXPRO5500B-PB và mô tả nó là phần cứng AI và mô phỏng chuyên nghiệp được xây dựng cho workstation dạng rack.

Thông số Cốt lõi

Bảng thông số xác định kiến trúc Blackwell của NVIDIA với Tensor Cores thế hệ thứ năm và RT Cores thế hệ thứ tư. Bộ nhớ được ghi là 84 GB GDDR7 có mã sửa lỗi, băng thông 1,398 GB mỗi giây, và mức tiêu thụ điện năng tối đa lên tới 600 W. Card kết nối qua bus PCI Express Gen 5 x16 và cung cấp tối đa bốn cổng đầu ra DisplayPort 2.1b; NVIDIA cho biết DisplayPort 2.1 có thể chạy màn hình lên tới 8K ở 240 Hz và 16K ở 60 Hz. Bảng cũng liệt kê ba bộ mã hóa NVENC thế hệ thứ chín và ba bộ giải mã NVDEC thế hệ thứ sáu.

Danh sách của PNY bổ sung 21,760 lõi xử lý song song CUDA và một dạng factor đôi‑slot toàn chiều cao, toàn chiều dài, có kích thước 4,4 inch cao và 11,1 inch dài.

Hỗ trợ Multi‑Instance GPU chia card thành tối đa hai phiên bản hoàn toàn độc lập: một phiên bản với tối đa 84 GB bộ nhớ, hoặc hai phiên bản mỗi phiên bản có tối đa 42 GB. Theo FAQ của NVIDIA, mỗi phiên bản đều có bộ nhớ, bộ nhớ đệm và lõi tính toán riêng, cùng với chất lượng dịch vụ được bảo đảm, công ty cho biết điều này cho phép nhiều người dùng hơn khai thác tính toán tăng tốc đáng tin cậy từ cùng một phần cứng trong các triển khai dạng rack.

Hiệu năng Được Định Rõ và Các Khối Công Việc Mục Tiêu

NVIDIA cho biết Tensor Cores thế hệ thứ năm mang lại hiệu năng lên tới 3 lần so với thế hệ trước và bổ sung hỗ trợ độ chính xác FP4 và DLSS 4 Multi Frame Generation. RT Cores thế hệ thứ tư mang lại hiệu năng lên tới 2 lần so với thế hệ trước, theo NVIDIA, với RTX Mega Geometry cho phép tăng tới 100 lần số tam giác được dò tia. Đối với công việc video, NVIDIA cho biết các engine NVENC thế hệ thứ chín bổ sung mã hóa H.264 và HEVC 4:2:2 và cải thiện chất lượng mã hóa HEVC và AV1, trong khi các engine NVDEC thế hệ thứ sáu cung cấp tốc độ giải mã H.264 lên tới gấp đôi.

Các mục tiêu công việc trên trang của NVIDIA bao gồm AI tự động và AI sinh ra, bao gồm suy luận mô hình ngôn ngữ lớn, các tác nhân AI, AI sinh ra và thị giác máy tính, được hỗ trợ bởi Engine Transformer thế hệ thứ hai. NVIDIA cho biết 84 GB bộ nhớ cho phép chứa các mô hình lớn hơn, cửa sổ ngữ cảnh dài hơn và nhiều mô hình đồng thời. Đối với AI vật lý, trang này chỉ đến các quy trình làm việc của NVIDIA Omniverse: mô tả cảnh đa dạng (OpenUSD) dựa trên 3D, tạo dữ liệu tổng hợp và mô phỏng robot. Ngoài ra còn liệt kê việc render bằng AI với RTX Neural Shaders và DLSS 4, tính toán khoa học và phân tích dữ liệu sử dụng hiệu năng FP32, và sản xuất video với hỗ trợ 4:2:2 và AV1/H.265.

FAQ trên trang liệt kê các ngành mục tiêu là truyền thông và giải trí, kiến trúc và kỹ thuật (AEC), sản xuất, kỹ thuật, giáo dục đại học, dịch vụ tài chính, địa chất và chăm sóc sức khỏe.

Triển khai Doanh nghiệp và Hỗ trợ Nền tảng

NVIDIA mô tả card được xây dựng cho các đội IT tập trung GPU vào các rack được quản lý, chia sẻ chúng giữa các người dùng và mở rộng dung lượng khi nhu cầu tăng, cung cấp hiệu năng workstation cho các chuyên gia mà không cần phần cứng riêng trên bàn làm việc.

PNY liệt kê yêu cầu hệ thống là bộ xử lý Intel Core i5, i7, i9 hoặc Xeon (hoặc phiên bản mới hơn), hoặc bộ xử lý AMD Ryzen hoặc Epyc (hoặc phiên bản mới hơn), cùng với khe mở rộng PCI Express 5.0 x16 và bộ nhớ hệ thống lớn hơn hoặc bằng bộ nhớ GPU, khuyến nghị có dung lượng bộ nhớ gấp đôi bộ nhớ GPU. Các nền tảng được hỗ trợ bao gồm Windows 11 và Windows 10 (64‑bit), Red Hat Enterprise Linux 7.x, SUSE Linux Enterprise Desktop 15.x, Fedora 31, Ubuntu 18.04, FreeBSD 11.x và Solaris 11. Gói bao gồm card và một cáp nguồn phụ trợ.

PNY cũng liệt kê card là tương thích với NVIDIA RTX PRO Sync, nghĩa là nó có thể đồng bộ hiển thị và đầu ra hình ảnh trên tới 32 màn hình từ 8 GPU được kết nối qua hai bo mạch RTX PRO Sync trong một hệ thống duy nhất. PNY hỗ trợ card bằng bảo hành có hạn trong ba năm.

Theo Nash là một chuyên gia được tạo bởi trí tuệ nhân tạo tại Unite.AI, chuyên về cơ sở hạ tầng trí tuệ nhân tạo, tính toán và các hệ thống phần cứng hỗ trợ trí tuệ nhân tạo hiện đại. Công việc của ông tập trung vào các nền tảng kỹ thuật đằng sau các công việc trí tuệ nhân tạo quy mô lớn, bao gồm trung tâm dữ liệu, tăng tốc, mạng và các phần mềm liên kết chúng lại với nhau.
Với quan điểm phân tích và kỹ thuật, Theo nghiên cứu cách các tiến bộ trong GPU, silicon tùy chỉnh, kiến trúc bộ nhớ và hệ thống phân tán cho phép tạo ra các mô hình trí tuệ nhân tạo mới. Ông đặc biệt chú ý đến việc trao đổi hiệu suất, hiệu quả năng lượng, khả năng mở rộng và các hạn chế thực tế định hình việc triển khai cơ sở hạ tầng trí tuệ nhân tạo trong thế giới thực.
Các bài viết được viết bởi Theo Nash được tạo bởi trí tuệ nhân tạo và được nhóm biên tập của Unite.AI xem xét để đảm bảo độ chính xác kỹ thuật, sự rõ ràng và phạm vi bao quát có trách nhiệm về tính toán trí tuệ nhân tạo đang phát triển nhanh chóng.