Modely a platformy AI

NVIDIA přidává RTX PRO 5500 Blackwell GPU s 84 GB pamětí GDDR7

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

NVIDIA uvedla RTX PRO 5500 Blackwell Workstation Edition, profesionální grafickou kartu s 84 GB pamětí GDDR7 určenou pro nasazení ve stojacích pracovních stanicích v racku, na své oficiální produktové stránce, kde je dostupnost označena jako „již brzy“. PNY Technologies také uvádí kartu na své vlastní produktové stránce.

Umístění v racku

Produktová stránka představuje kartu pod sloganem “Powering the next era of AI” a vyzývá návštěvníky, aby se zaregistrovali a byli informováni, až bude k dispozici. NVIDIA upozorňuje, že zveřejněné specifikace jsou předběžné a mohou se změnit.

NVIDIA umisťuje RTX PRO 5500 pro nasazení ve stojacích pracovních stanicích v racku po celé podniku a popisuje model, ve kterém týmy centralizují, sdílejí a rozšiřují výkon GPU pracovních stanic. Karta je nabízena s možností chlazení vzduchem nebo kapalinou; tabulka specifikací uvádí aktivní design s vzduchovým chlazením a poznamenává, že řešení s kapalinovým chlazením je k dispozici ve form factoru RXM.

PNY uvádí stejnou kartu pod SKU VCNRTXPRO5500B-PB a popisuje ji jako profesionální AI a simulační hardware určený pro pracovní stanice v racku.

Základní specifikace

Tabulka specifikací identifikuje NVIDIA architekturu Blackwell s pátou generací Tensor Core a čtvrtou generací RT Core. Paměť je uvedena jako 84 GB GDDR7 s korekcí chyb, šířka pásma 1 398 GB za sekundu a maximální spotřeba energie až 600 W. Karta se připojuje přes sběrnici PCI Express Gen 5 x16 a poskytuje až čtyři výstupy DisplayPort 2.1b; NVIDIA uvádí, že DisplayPort 2.1 dokáže ovládat displeje až do 8K při 240 Hz a 16K při 60 Hz. Tabulka také uvádí tři enkodéry NVENC deváté generace a tři dekodéry NVDEC šesté generace.

PNY ve svém výpisu uvádí 21 760 paralelních výpočetních jader CUDA a plnovýškový, plnoširoký dvoj-slotový form factor o rozměrech 4,4 palce výšky a 11,1 palce délky.

Podpora Multi-Instance GPU rozděluje kartu na až dvě zcela izolované instance: jedna instance s až 84 GB paměti nebo dvě instance s až 42 GB každá. Podle FAQ od NVIDIA každá instance disponuje vyhrazenou pamětí, cache a výpočetními jádry spolu se zaručenou kvalitou služby, což společnost uvádí, že umožňuje více uživatelům využívat spolehlivé akcelerované výpočty ze stejného hardwaru v nasazeních v racku.

Uvedený výkon a cílové pracovní zatížení

NVIDIA uvádí, že Tensor Cores páté generace poskytují až 3‑násobek výkonu předchozí generace a přidávají podporu pro přesnost FP4 a DLSS 4 Multi Frame Generation. RT Cores čtvrté generace podle NVIDIA dosahují až 2‑násobku výkonu předchozí generace, přičemž RTX Mega Geometry umožňuje až 100‑násobek více ray‑tracených trojúhelníků. Pro video práci NVIDIA říká, že motory NVENC deváté generace přidávají kódování 4:2:2 H.264 a HEVC a zlepšují kvalitu kódování HEVC a AV1, zatímco motory NVDEC šesté generace poskytují až dvojnásobný průtok dekódování H.264.

Cílové úlohy na stránce NVIDIA zahrnují agentní a generativní AI, včetně inferencí velkých jazykových modelů, AI agentů, generativní AI a počítačového vidění, podpořené druhou generací Transformer Engine. NVIDIA uvádí, že 84 GB paměti umožňuje uložit větší modely, delší kontextová okna a více modelů najednou. Pro fyzickou AI stránka odkazuje na pracovní postupy NVIDIA Omniverse: 3D založené na Universal Scene Description (OpenUSD), generování syntetických dat a simulaci robotiky. Dále jsou uvedeny renderování poháněné AI s RTX Neural Shaders a DLSS 4, vědecké výpočty a analýza dat využívající výkon FP32 a produkce videa s podporou 4:2:2 a AV1/H.265.

FAQ na stránce uvádí média a zábavu, architekturu a inženýrství (AEC), výrobu, inženýrství, vyšší vzdělání, finanční služby, geovědy a zdravotnictví jako cílové odvětví.

Podnikové nasazení a podpora platforem

NVIDIA popisuje kartu jako vytvořenou pro IT týmy, aby centralizovaly GPU v řízených rackech, sdílely je mezi uživateli a rozšiřovaly kapacitu s rostoucí poptávkou, čímž poskytují výkon pracovních stanic profesionálům bez individuálního hardware na stole.

PNY uvádí systémové požadavky na procesor Intel Core i5, i7, i9 nebo Xeon (nebo novější), nebo procesor třídy AMD Ryzen či Epyc (nebo novější), spolu se slotem PCI Express 5.0 x16 a systémovou pamětí, která je větší nebo rovna paměti GPU, přičemž se doporučuje dvojnásobná kapacita paměti GPU. Podporované platformy zahrnují Windows 11 a Windows 10 (64‑bit), Red Hat Enterprise Linux 7.x, SUSE Linux Enterprise Desktop 15.x, Fedora 31, Ubuntu 18.04, FreeBSD 11.x a Solaris 11. Balíček obsahuje kartu a jeden pomocný napájecí kabel.

PNY také uvádí kartu jako kompatibilní s NVIDIA RTX PRO Sync, což znamená, že může synchronizovat výstup obrazu a displeje až na 32 displejích z 8 GPU připojených přes dvě RTX PRO Sync desky v jednom systému. PNY poskytuje kartě tříletou omezenou záruku.

Theo Nash je specialista na umělou inteligenci vygenerovaný v Unite.AI, který se zabývá infrastrukturou umělé inteligence, výpočetními systémy a hardwarovými systémy, které pohánějí moderní umělou inteligenci. Jeho práce se zaměřuje na technické základy velkých AI úloh, včetně datových center, akcelerátorů, sítí a softwarových balíčků, které je spojují.
S analytickým a inženýrským přístupem Theo zkoumá, jak pokroky v oblasti GPU, vlastních polovodičových součástek, architektur paměti a distribuovaných systémů umožňují nové generace AI modelů. Zvláštní pozornost věnuje obchodním kompromisům, energetické eficienci, škálovatelnosti a praktickým omezením, které formují reálné nasazení AI infrastruktury.
Články napsané Theo Nashem jsou vygenerovány umělou inteligencí a recenzovány redakčním týmem Unite.AI, aby zajistily technickou přesnost, srozumitelnost a zodpovědné pokrytí rychle se vyvíjejícího AI výpočetního prostředí.