AI 모델 및 플랫폼

NVIDIA, 84GB GDDR7 메모리를 장착한 RTX PRO 5500 Blackwell GPU 추가

mm
Unite.AI를 Google의 선호 소스에 추가

NVIDIA는 공식 제품 페이지에 84GB GDDR7 메모리를 탑재하고 랙 장착 워크스테이션 배치를 위해 설계된 전문 그래픽 카드인 RTX PRO 5500 Blackwell Workstation Edition을 등재했으며, 공급 가능 여부는 “곧 출시”로 표시했습니다. PNY Technologies도 자체 제품 페이지에 카드를 등재합니다.

랙 장착 배치

제품 페이지는 “Powering the next era of AI”라는 태그라인 아래 카드를 소개하고, 사용자가 출시 시 알림을 받을 수 있도록 가입하도록 유도합니다. NVIDIA는 공개된 사양이 예비 단계이며 변경될 수 있음을 각주로 명시합니다.

NVIDIA는 RTX PRO 5500을 기업 전반의 랙 장착 워크스테이션 배치를 위해 포지셔닝하며, 팀이 워크스테이션 GPU 성능을 중앙 집중화하고 공유하며 확장하는 모델을 설명합니다. 이 카드는 공랭식 또는 수랭식 열 관리 옵션 중 선택할 수 있도록 제공되며, 사양 표에는 액티브 공랭식 설계가 기재되고 수랭식 솔루션은 RXM 폼팩터에서 제공된다고 명시합니다.

PNY는 동일한 카드를 SKU VCNRTXPRO5500B-PB로 등재하고, 이를 랙 장착 워크스테이션용으로 설계된 전문 AI 및 시뮬레이션 하드웨어라고 설명합니다.

핵심 사양

사양 표는 NVIDIA의 Blackwell 아키텍처를 식별하며, 5세대 Tensor Core와 4세대 RT Core를 탑재했습니다. 메모리는 ECC가 적용된 84GB GDDR7이며, 대역폭은 초당 1,398GB, 최대 전력 소비는 600W까지입니다. 카드는 PCI Express Gen 5 x16 버스를 통해 연결되고 최대 4개의 DisplayPort 2.1b 출력을 제공합니다; NVIDIA는 DisplayPort 2.1이 8K 240Hz 및 16K 60Hz 디스플레이를 구동할 수 있다고 밝혔습니다. 표에는 또한 9세대 NVENC 인코더 3개와 6세대 NVDEC 디코더 3개가 나열되어 있습니다.

PNY의 목록에는 21,760개의 CUDA 병렬 처리 코어와 높이 4.4인치, 길이 11.1인치인 풀 하이트·풀 길이 듀얼 슬롯 폼팩터가 추가되었습니다.

멀티 인스턴스 GPU 지원은 카드를 최대 두 개의 완전 격리된 인스턴스로 분할합니다: 하나의 인스턴스는 최대 84GB 메모리를, 두 개의 인스턴스는 각각 최대 42GB 메모리를 제공합니다. NVIDIA FAQ에 따르면, 각 인스턴스는 전용 메모리, 캐시 및 연산 코어와 보장된 서비스 품질을 갖추고 있어, 랙 장착 환경에서 동일 하드웨어로 더 많은 사용자가 신뢰할 수 있는 가속 컴퓨팅을 활용할 수 있다고 합니다.

명시된 성능 및 목표 워크로드

NVIDIA에 따르면, 5세대 Tensor Core는 이전 세대 대비 최대 3배의 성능을 제공하며 FP4 정밀도와 DLSS 4 멀티 프레임 생성 지원을 추가합니다. 4세대 RT Core는 이전 세대 대비 최대 2배의 성능을 제공하며, RTX Mega Geometry 덕분에 레이 트레이싱 삼각형 수가 최대 100배 증가합니다. 비디오 작업에 대해서는, 9세대 NVENC 엔진이 4:2:2 H.264 및 HEVC 인코딩을 추가하고 HEVC와 AV1 인코딩 품질을 향상시킨다고 NVIDIA가 밝혔으며, 6세대 NVDEC 엔진은 H.264 디코딩 처리량을 최대 두 배로 제공합니다.

NVIDIA 페이지의 워크로드 목표는 에이전시 및 생성형 AI를 포괄하며, 대규모 언어 모델 추론, AI 에이전트, 생성형 AI, 컴퓨터 비전을 포함하고 2세대 Transformer Engine 지원을 기반으로 합니다. NVIDIA는 84GB 메모리가 더 큰 모델, 더 긴 컨텍스트 윈도우, 그리고 동시에 여러 모델을 수용할 수 있다고 말합니다. 물리적 AI 분야에서는 페이지가 NVIDIA Omniverse 워크플로우를 지목하는데, 이는 Universal Scene Description(OpenUSD) 기반 3D, 합성 데이터 생성, 로봇 시뮬레이션을 포함합니다. 또한 RTX Neural Shaders와 DLSS 4를 활용한 AI 기반 렌더링, FP32 성능을 이용한 과학 컴퓨팅 및 데이터 분석, 4:2:2 및 AV1/H.265 지원을 갖춘 비디오 제작이 나열됩니다.

페이지 FAQ에서는 미디어 및 엔터테인먼트, 건축 및 엔지니어링(AEC), 제조, 엔지니어링, 고등 교육, 금융 서비스, 지구과학, 의료 분야를 목표 산업으로 지정하고 있습니다.

기업 배포 및 플랫폼 지원

NVIDIA는 이 카드를 IT 팀이 GPU를 관리형 랙에 중앙 집중화하고 사용자 간에 공유하며 수요 증가에 따라 용량을 확장하도록 설계되었다고 설명합니다. 이를 통해 개별 데스크톱 하드웨어 없이도 전문가에게 워크스테이션 수준의 성능을 제공할 수 있습니다.

PNY는 시스템 요구 사항으로 Intel Core i5, i7, i9 또는 Xeon 프로세서(이후 모델) 혹은 AMD Ryzen 또는 Epyc급 프로세서(이후 모델)와 PCI Express 5.0 x16 확장 슬롯, GPU 메모리와 동등하거나 그보다 큰 시스템 메모리를 요구하며, 권장 메모리는 GPU 메모리의 두 배입니다. 지원 플랫폼에는 Windows 11 및 Windows 10(64비트), Red Hat Enterprise Linux 7.x, SUSE Linux Enterprise Desktop 15.x, Fedora 31, Ubuntu 18.04, FreeBSD 11.x, Solaris 11이 포함됩니다. 패키지에는 카드와 보조 전원 케이블 1개가 포함됩니다.

PNY는 또한 이 카드를 NVIDIA RTX PRO Sync 호환으로 등재하는데, 이는 단일 시스템 내 두 개의 RTX PRO Sync 보드를 통해 연결된 8개의 GPU가 최대 32개의 디스플레이에 걸쳐 디스플레이 및 이미지 출력을 동기화할 수 있음을 의미합니다. PNY는 이 카드에 3년 제한 보증을 제공합니다.

테오 내쉬유나이트.AI의 AI 생성 전문가로, AI 인프라, 컴퓨팅, 및 현대적인 인공 지능을 구동하는 하드웨어 시스템을 다룹니다. 그의 작업은 대규모 AI 워크로드를 위한 기술적 기초에 중점을 두고 있으며, 데이터 센터, 가속기, 네트워킹, 및 이를 연결하는 소프트웨어 스택을 포함합니다.
분석적이고 엔지니어링 중심의 관점에서 테오 내쉬는 GPU, 커스텀 실리콘, 메모리 아키텍처, 및 분산 시스템의 발전에 따라 새로운 세대의 AI 모델이 어떻게 가능해지는지 조사합니다. 그는 성능 트레이드오프, 에너지 효율성, 확장성, 및 실제로 AI 인프라를 배치하는 실질적인 제약에 특별한 주의를 기울입니다.
테오 내쉬가 작성한 기사들은 AI로 생성되어 유나이트.AI의 편집 팀에 의해 검토되어 기술적 정확성, 명확성, 및 급변하는 AI 컴퓨팅 환경에 대한 책임 있는 보도를 보장합니다.