AI 模型与平台

NVIDIA 推出配备 84 GB GDDR7 内存的 RTX PRO 5500 Blackwell GPU

mm
将 Unite.AI 添加到您在 Google 上的首选来源

NVIDIA 在其官方产品页面上列出了 RTX PRO 5500 Blackwell Workstation Edition,这是一款配备 84 GB GDDR7 内存、专为机架式工作站部署而设计的专业显卡,页面上标注为即将上市。PNY Technologies 也在其产品页面上 列出该卡

机架式定位

产品页面在标语”Powering the next era of AI”下展示该卡,并邀请访客注册以在其可用时收到通知。NVIDIA 在脚注中说明已发布的规格为初步信息,可能会更改。

NVIDIA 将 RTX PRO 5500 定位于企业级机架式工作站部署,描述了一种团队集中、共享并扩展工作站 GPU 能力的模式。该卡提供空气冷却或液体冷却两种散热方案;规格表列出主动空气冷却设计,并指出液体冷却方案可在 RXM 形态下提供。

PNY 在 SKU VCNRTXPRO5500B-PB 下列出同款卡,并将其描述为为机架式工作站打造的专业 AI 与仿真硬件。

核心规格

规格表标明 NVIDIA Blackwell 架构,配备第五代 Tensor Core 和第四代 RT Core。内存为 84 GB GDDR7,具纠错码,带宽为每秒 1,398 GB,最大功耗最高可达 600 W。该卡通过 PCI Express Gen 5 x16 总线连接,并提供最多四个 DisplayPort 2.1b 输出;NVIDIA 表示 DisplayPort 2.1 可驱动最高 8K@240 Hz 和 16K@60 Hz 的显示器。表中还列出三个第九代 NVENC 编码器和三个第六代 NVDEC 解码器。

PNY 的列表补充说明该卡拥有 21,760 个 CUDA 并行处理核心,采用全高全长双槽形态,尺寸为高 4.4 英寸、长 11.1 英寸。

多实例 GPU 支持将该卡划分为最多两个完全隔离的实例:一个实例可拥有最高 84 GB 内存,或两个实例各拥有最高 42 GB 内存。根据 NVIDIA 的 FAQ,每个实例都配备专用的内存、缓存和计算核心,并保证服务质量,NVIDIA 表示这使得更多用户在机架式部署中能够从同一硬件获得可靠的加速计算。

声明的性能与目标工作负载

NVIDIA 表示,第五代 Tensor Core 的性能最高可达前代的 3 倍,并新增对 FP4 精度和 DLSS 4 多帧生成的支持。第四代 RT Core 的性能最高可达前代的 2 倍,且 RTX Mega Geometry 可实现多达 100 倍的光线追踪三角形数量。针对视频工作,NVIDIA 称第九代 NVENC 引擎加入了 4:2:2 H.264 与 HEVC 编码,并提升了 HEVC 与 AV1 编码质量,而第六代 NVDEC 引擎则提供最高两倍的 H.264 解码吞吐量。

NVIDIA 页面上的工作负载目标涵盖代理式和生成式 AI,包括大语言模型推理、AI 代理、生成式 AI 和计算机视觉,并得到第二代 Transformer Engine 的支持。NVIDIA 表示,84 GB 内存可容纳更大的模型、更长的上下文窗口以及同时运行多个模型。针对实体 AI,页面指向 NVIDIA Omniverse 工作流:基于通用场景描述 (OpenUSD) 的 3D、合成数据生成和机器人仿真。还列出了使用 RTX Neural Shaders 与 DLSS 4 的 AI 加速渲染、利用 FP32 性能的科学计算与数据分析,以及支持 4:2:2 与 AV1/H.265 的视频制作。

页面的 FAQ 将媒体与娱乐、建筑与工程 (AEC)、制造业、工程、高等教育、金融服务、地球科学和医疗保健列为目标行业。

企业部署与平台支持

NVIDIA 将该卡描述为为 IT 团队打造,可将 GPU 集中到受管机架中,跨用户共享,并随需求增长而扩展容量,从而为专业人士提供工作站性能,而无需单独的桌面硬件。

PNY 列出的系统要求包括 Intel Core i5、i7、i9 或 Xeon 处理器(或更高版本),或 AMD Ryzen 或 Epyc 系列处理器(或更高版本),以及 PCI Express 5.0 x16 扩展槽,系统内存需大于或等于 GPU 内存,建议配备相当于 GPU 内存两倍的内存。支持的平台包括 Windows 11 与 Windows 10(64 位)、Red Hat Enterprise Linux 7.x、SUSE Linux Enterprise Desktop 15.x、Fedora 31、Ubuntu 18.04、FreeBSD 11.x 和 Solaris 11。包装内含显卡和一根辅助电源线。

PNY 还将该卡列为兼容 NVIDIA RTX PRO Sync,意味着它可通过两块 RTX PRO Sync 板在单系统中连接的 8 块 GPU,实现对多达 32 台显示器的显示和图像输出同步。PNY 为该卡提供三年有限保修。

Theo Nash 是 Unite.AI 的 AI 生成专家,负责报道 AI 基础设施、计算和支持现代人工智能的硬件系统。他的工作重点是大规模 AI 工作负载背后的技术基础,包括数据中心、加速器、网络和将它们连接起来的软件栈。具有分析和工程驱动的视角,Theo 检视 GPU、定制硅、内存架构和分布式系统的进步如何使新一代 AI 模型成为可能。他特别关注性能权衡、能效、可扩展性和实际约束,这些约束影响了 AI 基础设施的现实世界部署。 Theo Nash 撰写的文章由 Unite.AI 的编辑团队审查,以确保技术准确性、清晰度和对快速演变的 AI 计算领域的负责任报道。