Modele i platformy AI
NVIDIA Prezentuje Platformę Rubin: Następna Generacja Chipów AI
W kolejnym dużym ogłoszeniu na Konferencji Computex w Tajpej, CEO NVIDIA (NVDA ), Jensen Huang, ujawnił więcej planów firmy na przyszłość obliczeń AI. W centrum uwagi znalazła się platforma chipów AI Rubin, która ma zostać wydana w 2026 roku, oraz chip Blackwell Ultra, który ma zostać wydany w 2025 roku.
Platforma Rubin
Jako następca wysoko oczekiwanego architektury Blackwell, która ma zostać wydana później w 2024 roku, platforma Rubin reprezentuje duży krok do przodu w możliwościach obliczeniowych AI firmy NVIDIA. Huang podkreślił potrzebę przyspieszonych obliczeń, aby sprostać rosnącym wymaganiom przetwarzania danych, stwierdzając, “Doświadczamy inflacji obliczeniowej”. Technologia NVIDIA obiecuje dostarczyć imponujące 98% oszczędności kosztów i 97% redukcję zużycia energii, pozycjonując firmę jako lidera na rynku chipów AI.
Chociaż szczegółowe informacje o platformie Rubin były rzadkie, Huang ujawnił, że będzie ona zawierać nowe GPU i centralny procesor o nazwie Vera. Platforma będzie również zawierać HBM4, następną generację pamięci o wysokiej przepustowości, która stała się krytycznym wąskim gardłem w produkcji przyspieszaczy AI ze względu na rosnący popyt. Wiodący dostawca SK Hynix Inc. jest w dużej mierze wyprzedany HBM4 do 2025 roku, co podkreśla zaciętą konkurencję o ten niezbędny komponent.
NVIDIA i AMD na czele
Przejście NVIDIA do corocznego harmonogramu wydawniczego dla chipów AI podkreśla nasilającą się konkurencję na rynku chipów AI. Podczas gdy NVIDIA stara się utrzymać swoją pozycję lidera, inne giganty branży również robią znaczące postępy. Podczas otwarcia keynote na Computex 2024, przewodniczący i CEO AMD, Lisa Su, zaprezentowała rosnący popyt na rodzinę przyspieszaczy AMD Instinct, ujawniając wieloletni plan, który wprowadza coroczny rytm lidera AI i możliwości pamięci.
Plan AMD rozpoczyna się od przyspieszacza AMD Instinct MI325X, który ma zostać wydany w IV kwartale 2024 roku, z przewodzącą pojemnością pamięci i przepustowością. Firma również zapowiedziała procesory 5. generacji AMD EPYC, o kodowej nazwie “Turin”, które będą wykorzystywać rdzeń “Zen 5” i mają zostać wydane w drugiej połowie 2024 roku. Spójrzając w przyszłość, AMD planuje wydać przyspieszacze AMD Instinct MI400 w 2026 roku, oparte na architekturze AMD CDNA “Next”, obiecując zwiększoną wydajność i efektywność dla szkolenia i inferencji AI.
Wynik, Potencjalny Wpływ i Wyzwania
Wprowadzenie platformy Rubin przez NVIDIA i zobowiązanie firmy do corocznych aktualizacji przyspieszaczy AI mają daleko idące implikacje dla branży AI. Ten przyspieszony tempa innowacji i rozwoju umożliwi bardziej efektywne i opłacalne rozwiązania AI, napędzając postępy w różnych sektorach.
Chociaż platforma Rubin ma ogromny potencjał, istnieją wyzwania i rozważania, które muszą zostać rozwiązane. Wysoki popyt na pamięć HBM4 i ograniczenia dostaw nałożone przez wiodącego dostawcę SK Hynix Inc., który jest w dużej mierze wyprzedany do 2025 roku, mogą potencjalnie wpłynąć na produkcję i dostępność platformy Rubin.
Ponadto NVIDIA musi znaleźć delikatną równowagę między wydajnością, efektywnością i kosztami, aby zapewnić, że platforma Rubin pozostanie dostępna i opłacalna dla szerokiego zakresu klientów. Kompatybilność i bezproblemowa integracja z istniejącymi systemami będą również kluczowe, aby ułatwić przyjęcie i zminimalizować zakłócenia dla użytkowników.
Podczas gdy platforma Rubin otwiera drogę do przyspieszonej innowacji i rozwoju AI, firmy i badacze muszą pozostać poinformowani i przygotowani, aby wykorzystać te postępy. Dzięki wykorzystaniu platformy Rubin przez NVIDIA, organizacje z różnych branż mogą zwiększyć efektywność i uzyskać przewagę konkurencyjną na swoich rynkach.












