AI-modellen en platforms

Wat u moet weten over NVIDIA’s nieuwe Blackwell AI-superchip en -architectuur

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

NVIDIA (NVDA ), een pionier in de AI- en GPU-markt, heeft onlangs de lancering aangekondigd van zijn laatste innovatie, de Blackwell B200 GPU, samen met zijn krachtigere tegenhanger, de GB200-superchip, evenals andere indrukwekkende tools die deel uitmaken van de Blackwell-architectuur. Deze aankondiging markeert een significante stap voorwaarts in de AI-verwerkingsmogelijkheden, waarmee NVIDIA’s invloedrijke positie in een zeer concurrerende industrie wordt versterkt. De introductie van de Blackwell B200 en GB200 komt op een moment dat de vraag naar geavanceerdere AI-oplossingen toeneemt, met NVIDIA klaar om deze vraag direct te beantwoorden.

Blackwell B200: een nieuwe era in AI-verwerking

Het hart van NVIDIA’s laatste innovatie is de Blackwell B200 GPU, een technisch hoogstandje met een ongekende 20 petaflops aan FP4-verwerkingskracht, ondersteund door een verbijsterende 208 miljard transistors. Deze superchip staat als een getuigenis van NVIDIA’s onophoudelijke streven naar technologische excellentie, waarmee nieuwe normen worden gesteld in het domein van AI-verwerking.

Wanneer deze wordt vergeleken met zijn voorgangers, vertegenwoordigt de B200 GPU een monumentale stap voorwaarts in zowel efficiëntie als prestaties. NVIDIA’s voortdurende toewijding aan innovatie is duidelijk in de mogelijkheid van deze nieuwe chip om grote AI-modellen efficiënter dan ooit tevoren te verwerken. Deze efficiëntie is niet alleen een kwestie van verwerkingsnelheid, maar ook van energieverbruik, een cruciale factor in de huidige milieubewuste markt.

NVIDIA’s doorbraak in AI-chiptechnologie wordt ook weerspiegeld in de prijsstelling van de Blackwell B200, die voorlopig tussen de $30.000 en $40.000 is vastgesteld. Hoewel deze prijs de geavanceerde capaciteiten van de chip onderstreept, geeft het ook NVIDIA’s vertrouwen weer in de waarde die deze superchips brengen aan de voortdurend evoluerende AI-sector.

GB200 Superchip: het krachtige duo

NVIDIA introduceerde ook de GB200-superchip, een combinatie van twee Blackwell B200 GPU’s die in harmonie werken met een Grace CPU. Dit krachtige trio vertegenwoordigt een baanbrekende vooruitgang in AI-supercomputing. De GB200 is meer dan alleen de som van zijn onderdelen; het is een samenhangend geheel dat is ontworpen om de meest complexe en veeleisende AI-taken aan te pakken.

De GB200 onderscheidt zich door zijn verbijsterende prestatiecapaciteiten, met name in Large Language Model (LLM)-inference-werklasten. NVIDIA meldt dat de GB200 tot 30 keer de prestaties van zijn voorganger, het H100-model, levert. Deze kwantumsprong in prestatieparameters is een duidelijke indicator van de potentie van de GB200 om de AI-verwerkingslandschap te revolutioneren.

Verder dan zijn brute prestaties zet de GB200-superchip ook een nieuwe benchmark in energie- en kostenefficiëntie. In vergelijking met het H100-model belooft het aanzienlijk lagere operationele kosten en energieverbruik. Deze efficiëntie is niet alleen een technische prestatie, maar ook in overeenstemming met de groeiende vraag naar duurzame en kostenefficiënte computingoplossingen in AI.

Voortgang in connectiviteit en netwerk

De tweede generatie transformer engine van de GB200 speelt een cruciale rol bij het verbeteren van berekeningen, bandbreedte en modelgrootte. Door de neuronrepresentatie van acht bits naar vier te optimaliseren, verhoogt de engine effectief de berekeningscapaciteit, bandbreedte en modelgrootte. Deze innovatie is essentieel om de steeds complexere en grotere AI-modellen te beheren, waarmee NVIDIA voorop blijft in de AI-race.

Een opvallende vooruitgang in de GB200 is de verbeterde NVLink-switch, ontworpen om de inter-GPU-communicatie aanzienlijk te verbeteren. Deze innovatie maakt een hogere mate van efficiëntie en schaalbaarheid mogelijk in multi-GPU-configuraties, waarmee een van de belangrijkste uitdagingen in high-performance computing wordt aangepakt.

Een van de meest kritieke verbeteringen in de GB200-architectuur is de aanzienlijke reductie van communicatieoverhead, met name in multi-GPU-configuraties. Deze efficiëntie is cruciaal bij het optimaliseren van de prestaties van grote AI-modellen, waar inter-chipcommunicatie vaak een bottleneck kan zijn. Door deze overhead te minimaliseren, zorgt NVIDIA ervoor dat meer rekenkracht wordt gericht op daadwerkelijke verwerkingsTaken, waardoor AI-bewerkingen meer gestroomlijnd en effectief worden.

GB200 NVL72 (NVIDIA)

Verpakkingskracht: de NVL72-rack

Voor bedrijven die een grote hoeveelheid GPU’s willen kopen, komt de NVL72-rack naar voren als een significante toevoeging aan NVIDIA’s arsenaal, waarmee het een state-of-the-art ontwerp vertegenwoordigt in high-density computing. Deze vloeistofgekoelde rack is ontworpen om meerdere CPU’s en GPU’s te huisvesten, waarmee het een robuuste oplossing biedt voor intensieve AI-verwerkingsTaken. De integratie van vloeistofkoeling is een getuigenis van NVIDIA’s innovatieve aanpak om de thermische uitdagingen te tackelen die worden gesteld door high-performance computingomgevingen.

Een sleutelkenmerk van de NVL72-rack is zijn mogelijkheid om extreem grote AI-modellen te ondersteunen, wat essentieel is voor geavanceerde toepassingen op gebieden zoals natuurlijke taalverwerking en computerzicht. Deze mogelijkheid om kolossale AI-modellen te accommoderen en efficiënt uit te voeren, positioneert de NVL72 als een kritisch infrastructuuronderdeel in het domein van cutting-edge AI-onderzoek en -ontwikkeling.

NVIDIA’s NVL72-rack zal worden geïntegreerd in de cloudservices van grote technologiebedrijven, waaronder Amazon (AMZN ), Google (GOOGL ), Microsoft en Oracle. Deze integratie markeert een belangrijke stap in het meer toegankelijk maken van high-end AI-verwerkingskracht voor een breder scala aan gebruikers en toepassingen, waarmee de toegang tot geavanceerde AI-mogelijkheden wordt gedemocratiseerd.

Verder dan AI-verwerking naar AI-voertuigen en robotica

NVIDIA breidt zijn technologische expertise uit voorbij traditionele computingdomeinen naar de sectoren van AI-geactiveerde voertuigen en humanoïde robotica.

Project GR00T en Jetson Thor staan aan de voorzijde van NVIDIA’s avontuur in robotica. Project GR00T heeft als doel een fundamenteel model te bieden voor humanoïde robots, waarmee ze natuurlijke taal kunnen begrijpen en menselijke bewegingen kunnen imiteren. In combinatie met Jetson Thor, een systeem-op-een-chip dat specifiek is ontworpen voor robotica, markeren deze initiatieven NVIDIA’s ambities om autonome machines te creëren die in staat zijn om een breed scala aan taken uit te voeren met minimale menselijke interventie.

Een andere intrigerende ontwikkeling is dat NVIDIA een simulatie van een quantum computing-service heeft geïntroduceerd. Hoewel dit niet direct verbonden is met een echte quantumcomputer, maakt deze service gebruik van NVIDIA’s AI-chips om quantum computingomgevingen te simuleren. Dit initiatief biedt onderzoekers een platform om quantum computingoplossingen te testen en te ontwikkelen zonder de noodzaak van dure en schaarse quantum computingbronnen. In de toekomst plant NVIDIA om toegang te bieden tot quantumcomputers van derden, waarmee het zijn intrede maakt in een van de meest geavanceerde domeinen in computing.

NVIDIA blijft de AI-landschap herschappen

NVIDIA’s introductie van de Blackwell B200 GPU en GB200-superchip markeert nog een transformatief moment in het veld van kunstmatige intelligentie. Deze vooruitgang is niet alleen een incrementele update; het vertegenwoordigt een significante stap voorwaarts in AI-verwerkingsmogelijkheden. De Blackwell B200, met zijn ongekende verwerkingskracht en efficiëntie, stelt een nieuwe benchmark in de industrie. De GB200-superchip verheft deze standaard verder door ongekende prestaties te bieden, met name in grote AI-modellen en inference-werklasten.

De bredere implicaties van deze ontwikkelingen gaan verder dan NVIDIA’s portfolio. Ze signaleren een verschuiving in de technologische capaciteiten die beschikbaar zijn voor AI-ontwikkeling, waardoor nieuwe wegen voor innovatie worden geopend in verschillende sectoren. Door de verwerkingskracht aanzienlijk te verhogen en tegelijkertijd te focussen op energie-efficiëntie en schaalbaarheid, legt NVIDIA’s Blackwell-serie de basis voor meer geavanceerde, duurzame en toegankelijke AI-toepassingen.

Deze stap voorwaarts door NVIDIA zal waarschijnlijk de vooruitgang in AI versnellen, waardoor de industrie naar complexere, real-worldtoepassingen wordt gestuwd, waaronder AI-geactiveerde voertuigen, geavanceerde robotica en zelfs exploraties naar quantum computing-simulaties. De impact van deze innovaties zal worden gevoeld in het hele technologielandschap, bestaande paradigma’s uitdagend en de weg vrijmakend voor een toekomst waarin de potentie van AI alleen wordt beperkt door de verbeelding.

Alex McFarland is een AI-journalist en schrijver die de laatste ontwikkelingen op het gebied van kunstmatige intelligentie onderzoekt. Hij heeft samengewerkt met talloze AI-startups en publicaties wereldwijd.