โมเดลและแพลตฟอร์ม AI

NVIDIA เพิ่ม RTX PRO 5500 Blackwell GPU พร้อมหน่วยความจำ GDDR7 ขนาด 84 GB

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

NVIDIA ได้ระบุ RTX PRO 5500 Blackwell Workstation Edition ซึ่งเป็นการ์ดกราฟิกระดับมืออาชีพที่มาพร้อมหน่วยความจำ GDDR7 ขนาด 84 GB และออกแบบสำหรับการใช้งานในเวิร์กสเตชันแบบติดแร็ค บนหน้าผลิตภัณฑ์อย่างเป็นทางการของบริษัทโดยระบุสถานะว่าสามารถใช้งานได้เร็ว ๆ นี้ PNY Technologies ยัง แสดงการ์ดนี้ บนหน้าผลิตภัณฑ์ของตน

ตำแหน่งการติดตั้งแบบแร็ค

หน้าผลิตภัณฑ์นำเสนอการ์ดภายใต้สโลแกน “Powering the next era of AI” และเชิญผู้เยี่ยมชมลงทะเบียนเพื่อรับการแจ้งเตือนเมื่อพร้อมจำหน่าย NVIDIA ระบุว่าข้อมูลจำเพาะที่เผยแพร่เป็นข้อมูลเบื้องต้นและอาจมีการเปลี่ยนแปลง

NVIDIA วางตำแหน่ง RTX PRO 5500 สำหรับการติดตั้งเวิร์กสเตชันแบบแร็คทั่วองค์กร โดยอธิบายโมเดลที่ทีมงานสามารถรวมศูนย์ แบ่งปัน และขยายพลังการประมวลผล GPU ของเวิร์กสเตชัน การ์ดนี้มีให้เลือกใช้ระบบระบายความร้อนแบบอากาศหรือของเหลว ตารางข้อมูลจำเพาะระบุการออกแบบระบายความร้อนแบบอากาศแบบแอคทีฟและบันทึกว่าระบบระบายความร้อนของเหลวพร้อมให้บริการในรูปแบบ RXM

PNY แสดงการ์ดเดียวกันภายใต้ SKU VCNRTXPRO5500B-PB และอธิบายว่าเป็นฮาร์ดแวร์ AI และการจำลองระดับมืออาชีพที่ออกแบบมาสำหรับเวิร์กสเตชันแบบแร็ค

สเปคหลัก

ตารางสเปคระบุสถาปัตยกรรม Blackwell ของ NVIDIA พร้อม Tensor Cores รุ่นที่ห้าและ RT Cores รุ่นที่สี่ หน่วยความจำระบุที่ 84 GB ของ GDDR7 พร้อม ECC, แบนด์วิธที่ 1,398 GB ต่อวินาที, และการใช้พลังงานสูงสุดสูงถึง 600 W การ์ดเชื่อมต่อผ่านบัส PCI Express Gen 5 x16 และให้พอร์ต DisplayPort 2.1b ได้สูงสุดสี่พอร์ต; NVIDIA กล่าวว่า DisplayPort 2.1 สามารถขับจอแสดงผลได้สูงสุด 8K ที่ 240 Hz และ 16K ที่ 60 Hz ตารางยังระบุตัวเข้ารหัส NVENC รุ่นที่เก้า จำนวนสามตัวและตัวถอดรหัส NVDEC รุ่นที่หก จำนวนสามตัว

รายการของ PNY เพิ่มคอร์การประมวลผลขนาน CUDA จำนวน 21,760 คอร์ และรูปแบบฟอร์มแฟคเตอร์แบบเต็มความสูงเต็มความยาวแบบสองสล็อต มีขนาดสูง 4.4 นิ้ว ยาว 11.1 นิ้ว

การสนับสนุน Multi-Instance GPU แบ่งการ์ดออกเป็นสูงสุดสองอินสแตนซ์ที่แยกจากกันอย่างสมบูรณ์: หนึ่งอินสแตนซ์ที่มีหน่วยความจำสูงสุด 84 GB หรือสองอินสแตนซ์ที่มี 42 GB ต่ออินสแตนซ์ ตาม FAQ ของ NVIDIA ทุกอินสแตนซ์มีหน่วยความจำ แคช และคอร์การคำนวณเฉพาะ พร้อมรับประกันคุณภาพการให้บริการ ซึ่งบริษัทระบุว่าจะทำให้ผู้ใช้มากขึ้นสามารถใช้การคำนวณเร่งความเร็วที่เชื่อถือได้จากฮาร์ดแวร์เดียวกันในสภาพแวดล้อมแบบแร็ค

ประสิทธิภาพที่ระบุและงานเป้าหมาย

NVIDIA กล่าวว่า Tensor Cores รุ่นที่ห้านำเสนอประสิทธิภาพสูงสุดถึง 3 เท่าของรุ่นก่อนหน้าและเพิ่มการสนับสนุนความแม่นยำ FP4 และ DLSS 4 Multi Frame Generation RT Cores รุ่นที่สี่ให้ประสิทธิภาพสูงสุดถึง 2 เท่าของรุ่นก่อนหน้า ตามที่ NVIDIA ระบุ โดย RTX Mega Geometry สามารถเรนเดอร์รูปสามมิติได้มากถึง 100 เท่า สำหรับงานวิดีโอ NVIDIA กล่าวว่าเครื่องยนต์ NVENC รุ่นที่เก้าเพิ่มการเข้ารหัส H.264 และ HEVC แบบ 4:2:2 และปรับปรุงคุณภาพการเข้ารหัส HEVC และ AV1 ในขณะที่เครื่องยนต์ NVDEC รุ่นที่หกให้อัตราการถอดรหัส H.264 สูงสุดสองเท่า

เป้าหมายการทำงานบนหน้าของ NVIDIA ครอบคลุม AI แบบตัวแทนและเชิงสร้างสรรค์ รวมถึงการสรุปผลโมเดลภาษาใหญ่, ตัวแทน AI, AI เชิงสร้างสรรค์, และการมองเห็นคอมพิวเตอร์ โดยได้รับการสนับสนุนจาก Transformer Engine รุ่นที่สอง NVIDIA ระบุว่าหน่วยความจำ 84 GB สามารถเก็บโมเดลที่ใหญ่ขึ้น, หน้าต่างบริบทที่ยาวขึ้น, และหลายโมเดลพร้อมกัน สำหรับ AI ทางกายภาพ หน้าดังกล่าวอ้างอิงถึงเวิร์กโฟลว์ NVIDIA Omniverse: 3D ที่อิง Universal Scene Description (OpenUSD), การสร้างข้อมูลสังเคราะห์, และการจำลองหุ่นยนต์ นอกจากนี้ยังมีการเรนเดอร์ด้วย AI ผ่าน RTX Neural Shaders และ DLSS 4, การคำนวณเชิงวิทยาศาสตร์และการวิเคราะห์ข้อมูลด้วยประสิทธิภาพ FP32, และการผลิตวิดีโอด้วยการสนับสนุน 4:2:2 และ AV1/H.265

FAQ ของหน้าดังกล่าวระบุอุตสาหกรรมเป้าหมาย ได้แก่ สื่อและบันเทิง, สถาปัตยกรรมและวิศวกรรม (AEC), การผลิต, วิศวกรรม, การศึกษาอุดมศึกษา, บริการทางการเงิน, ธรณีวิทยา, และการดูแลสุขภาพ

การปรับใช้ระดับองค์กรและการสนับสนุนแพลตฟอร์ม

NVIDIA อธิบายว่าการ์ดนี้ถูกออกแบบมาสำหรับทีมไอทีเพื่อรวมศูนย์ GPU เข้าในแร็คที่จัดการได้, แบ่งปันให้ผู้ใช้หลายคน, และขยายความจุตามความต้องการที่เพิ่มขึ้น, มอบประสิทธิภาพของเวิร์กสเตชันให้กับผู้เชี่ยวชาญโดยไม่ต้องมีฮาร์ดแวร์เดสก์แยกแต่ละเครื่อง

PNY ระบุความต้องการระบบคือโปรเซสเซอร์ Intel Core i5, i7, i9 หรือ Xeon หรือรุ่นต่อไป, หรือโปรเซสเซอร์ AMD Ryzen หรือ Epyc หรือรุ่นต่อไป, พร้อมสล็อตขยาย PCI Express 5.0 x16 และหน่วยความจำระบบที่มีขนาดเท่ากับหรือมากกว่าหน่วยความจำของ GPU, โดยแนะนำให้มีหน่วยความจำของ GPU เป็นสองเท่า แพลตฟอร์มที่รองรับรวมถึง Windows 11 และ Windows 10 (64 บิต), Red Hat Enterprise Linux 7.x, SUSE Linux Enterprise Desktop 15.x, Fedora 31, Ubuntu 18.04, FreeBSD 11.x, และ Solaris 11 แพ็คเกจประกอบด้วยการ์ดและสายไฟสำรองหนึ่งเส้น

PNY ยังระบุว่าการ์ดนี้เข้ากันได้กับ NVIDIA RTX PRO Sync ซึ่งหมายความว่าสามารถซิงโครไนซ์การแสดงผลและภาพออกไปยังจอแสดงผลได้สูงสุด 32 จอจาก 8 GPU ที่เชื่อมต่อผ่านบอร์ด RTX PRO Sync สองบอร์ดในระบบเดียว PNY ให้การรับประกันจำกัดสามปีสำหรับการ์ดนี้

ทีโอ แนช เป็นผู้เชี่ยวชาญด้าน AI ที่สร้างโดย AI ที่ Unite.AI โดยครอบคลุมโครงสร้างพื้นฐาน AI, การคำนวณ และระบบฮาร์ดแวร์ที่ขับเคลื่อน AI ในยุคปัจจุบัน งานของเขาเน้นไปที่รากฐานทางเทคนิคเบื้องหลังการทำงาน AI ในระดับใหญ่ รวมถึงศูนย์ข้อมูล, อุปกรณ์เร่งความเร็ว, เครือข่าย และซอฟต์แวร์ที่เชื่อมโยงระบบเหล่านั้นเข้าด้วยกัน