AI-modeller og platforme

Nvidia’s Bekendtgørelser på Computex Taipei – En Gennemgang

mm
Føj Unite.AI til dine foretrukne kilder på Google

I en keynote, der var fuld af elektrificerende åbenbaringer på det seneste Computex Taipei-konference, afslørede NVIDIA’s (NVDA ) administrerende direktør, Jensen Huang, officielt Grace Hopper-platformen. Denne innovative kombination af den energoeffektive Nvidia Grace CPU og den højtydende Nvidia H100 Tensor Core GPU markerer en ny horisont i virksomhedsniveauets AI-funktioner.

Præsentation af Grace Hopper og DGX GH200

Denne omfattende AI-modul var ikke den eneste bemærkelsesværdige bekendtgørelse, som Huang gjorde. DGX GH200, en kraftfuld AI-supercomputer, tog også scenen. Med ekstraordinære hukommelsesevner kan denne supercomputer rumme op til 256 Nvidia Grace Hopper Superchips inden for en GPU på størrelse med et typisk datacenter.

DGX GH200 er virkelig en kraftpakke, der leverer en exaflop præstation og har en imponerende 144 terabytes delt hukommelse. Dette overgår langt dens forgængere med en faktor på 500, hvilket åbner døren for udviklere til at konstruere komplekse sprogmodeller til næste generations AI-chatbots, udvikle avancerede algoritmer til anbefalingsystemer og bygge sofistikerede grafneurale netværk, der er afgørende for svigagtig opdagelse og dataanalyseopgaver. Som Huang fremhævede, har tech-ledere som Google Cloud, Meta og Microsoft (MSFT ) allerede begyndt at udnytte DGX GH200’s muligheder til at håndtere deres generative AI-arbejdsmængder.

“DGX GH200 AI-supercomputere integrerer Nvidia’s mest avancerede accelererede beregning og netværksteknologier, hvilket flytter grænserne for AI,” fremhævede Huang.

Nvidia Avatar Cloud Engine (ACE) til Spil

I en stor bekendtgørelse, der satte fokus på spiludviklere, afslørede Huang Nvidia Avatar Cloud Engine (ACE) til spil. Denne foundry-service giver udviklere mulighed for at oprette og implementere brugerdefinerede AI-modeller til tale, samtale og animation. ACE-værktøjet giver ikke-spilbare karakterer mulighed for at engagere sig i samtale, hvilket giver dem mulighed for at reagere på forespørgsler med kontinuerligt udviklende livlige personligheder.

Dette kraftfulde værktøj består af nøgle-AI-grundmodeller, såsom Nvidia Riva til talegenkendelse og transskription, Nvidia NeMo til oprettelse af brugerdefinerede svar, og Nvidia Omniverse Audio2Face til at animere disse svar.

Nvidia og Microsofts Samarbejdsindsats

Keynoten fremhævede også Nvidia’s nye partnerskab med Microsoft til at fremme generativ AI på Windows-PC’er. Dette samarbejde vil udvikle forbedrede værktøjer, rammer og drivere til at forenkle AI-udviklingen og -implementeringen på PC’er.

Samarbejdet vil udvide og forbedre den eksisterende basis på over 100 millioner PC’er, der er udstyret med RTX-GPU’er med Tensor-kerner. Denne forbedring lover at øge ydeevnen for over 400 AI-accelererede Windows-applikationer og spil.

Generativ AI og Digital Reklame:

Ifølge Huang udvider generativ AI’s potentiale sig også til digital reklame. Nvidia har indgået et samarbejde med WPP, en markedsføringsorganisation, til at udvikle en innovativ indholdsmotor på Omniverse Cloud-platformen.

Denne motor forbinder kreative hold med 3D-designværktøjer som Adobe Substance 3D til at oprette digitale tvillinge af kundeprodukter inden for Nvidia Omniverse. Gennem brug af GenAI-værktøjer, drevet af Nvidia Picasso og trænet på ansvarligt kildevæsen, kan disse hold nu hurtigt generere virtuelle sæt. Denne revolutionerende funktion giver WPP’s kunder mulighed for at producere en bred vifte af reklamer, videoer og 3D-oplevelser, tilpasset globale markeder og tilgængelige på enhver webenhed.

Digital Revolution i Fremstilling

En af Nvidia’s primære fokusområder har været fremstilling, en kæmpeindustri på 46 billioner dollars, der består af omkring 10 millioner fabrikker. Huang fremhævede, hvordan elektronikfabrikanter som Foxconn Industrial Internet, Innodisk, Pegatron, Quanta og Wistron udnytter Nvidia-teknologier. Ved at antage digitale arbejdsgange nærmer disse virksomheder sig drømmen om fuldt digitale smarte fabrikker.

“Verdens største industrier skaber fysiske ting. Ved at bygge dem digitalt først kan vi spare milliarder,” sagde Huang.

Integreringen af Omniverse og generative AI-API’er har gjort det muligt for disse virksomheder at oprette broer mellem design- og fremstillingsværktøjer, oprette digitale tvillinge af deres fabrikker – digitale tvillinge. Desuden bruger de Nvidia Isaac Sim til at simulere og teste robotter og Nvidia Metropolis – et visions AI-rammeværk – til automatiseret optisk inspektion. Nvidia’s nyeste tilbud, Nvidia Metropolis for Fabrikker, åbner vejen for oprettelse af brugerdefinerede kvalitetskontrolsystemer, giver fabrikanterne en konkurrencefordel og muliggør udvikling af avancerede AI-applikationer.

Opførelse af Nvidia Helios og Introduktion af Nvidia MG

Desuden afslørede Nvidia opførelsen af den imponerende AI-supercomputer, Nvidia Helios. Forventet at blive operativ senere i år, vil Helios udnytte fire sammenkoblede DGX GH200-systemer med Nvidia Quantum-2 InfiniBand-netværk, der tilbyder en båndbredde på op til 400Gb/s. Dette vil dramatisk øge data-gennemstrømning for træning af store AI-modeller.

Til disse banebrydende udviklinger kompletterer Nvidia introduktionen af Nvidia MGX, en modulær referencearkitektur, der giver systemfabrikanter mulighed for at oprette en række serverkonfigurationer tilpasset AI-, HPC- og Nvidia Omniverse-applikationer på en kosteffektiv og effektiv måde.

Med MGX-arkitekturen kan fabrikanter udvikle standardiserede CPU’er og accelererede servere ved hjælp af modulære komponenter. Disse konfigurationer understøtter en række GPU’er, CPU’er, dataprocessorenheder (DPUs) og netværksadaptere, herunder x86- og Arm-processorer. MGX-konfigurationer kan placeres i både luft- og væskeafkølede kabinetter. Førende virksomheder som QCT og Supermicro er i spidsen for at antage MGX-design, og andre store virksomheder som ASRock Rack, ASUS, GIGABYTE og Pegatron forventes at følge.

Revolutionering af 5G-Infrastruktur og Cloud-Netværk

Med henblik på fremtiden annoncerede Huang en række partnerskaber med det formål at revolutionere 5G-infrastruktur og cloud-netværk. Et bemærkelsesværdigt partnerskab med en japansk teleselskabsgigant vil udnytte Nvidia’s Grace Hopper og BlueField-3 DPUs inden for modulære MGX-systemer til at udvikle et distribueret netværk af datacenter.

Ved at integrere Nvidia spectrum ethernet-switcher vil datacenterne give den nøjagtige tidsstyring, som 5G-protokollen kræver, hvilket fører til forbedret spektraleffektivitet og lavere energiforbrug. Platformen har potentiale for en bred vifte af anvendelser, herunder selvstændig kørsel, AI-fabrikker, forstærket og virtuel virkelighed, computerseende og digitale tvillinge.

Desuden afslørede Huang Nvidia Spectrum-X, en netværksplatform designet til at forbedre ydeevnen og effektiviteten af ethernet-baserede AI-clouds. Ved at kombinere Spectrum-4 Ethernet-switcher med BlueField-3 DPUs og software tilbyder Spectrum-X en 1,7 gange forbedring af AI-ydeevne og effektivitet. Store systemfabrikanter som Dell Technologies (DELL ), Lenovo og Supermicro tilbyder allerede Nvidia Spectrum-X, Spectrum-4-switcher og BlueField-3 DPUs.

Etablering af Generativ AI-Supercomputercenter

Nvidia gør også massive fremskridt i etableringen af generative AI-supercomputercenter verden over. Bemærkelsesværdigt er, at virksomheden opfører Israel-1, en state-of-the-art-supercomputer, inden for sit lokale datacenter i Israel. Denne supercomputer har til formål at fremme lokale forsknings- og udviklingsindsats.

Og i Taiwan er to nye supercomputere under udvikling: Taiwania 4 og Taipei-1. Disse tilføjelser lover at betydeligt forbedre lokale forsknings- og udviklingsinitiativer, hvilket styrker Nvidia’s engagement i at fremme AI- og supercomputergrænser verden over.

Alex leder Unite.AI’s AI‑drevne nyhedsoperationer, der kombinerer journalistik, forskning og automatisering for at understøtte rettidig og skalerbar dækning af kunstig intelligens. Hans arbejde sikrer, at nye AI‑udviklinger fremhæves effektivt, samtidig med at publikationsredaktionens standarder opretholdes.