AI-mallit ja alustat
Purkaminen Nvidian Ilmoituksista Computex Taipeissa

Nvidian toimitusjohtaja Jensen Huang esitteli virallisesti Grace Hopper -alustan Computex Taipein konferenssissa. Tämä innovatiivinen yhdistelmä energiatehokkaasta Nvidia (NVDA ) Grace -suorittimesta ja korkean suorituskyvyn Nvidia H100 Tensor Core -GPU:sta edustaa uuden aikakauden yritystason AI-toiminnallisuudessa.
Grace Hopperin ja DGX GH200:n Esittely
Tämä kattava AI-moduuli ei ollut ainoa merkittävä ilmoitus, jonka Huang teki. DGX GH200, voimakas AI-supercomputer, otti myös keskeisen roolin. Omistaessaan poikkeukselliset muistiominaisuudet, tämä supercomputer voi sisältää jopa 256 Nvidia Grace Hopper -superchippiä yhden GPU:n kokoisessa tietokeskuksessa.
DGX GH200 on todella voimakas, tarjoaa exaflopin suorituskyvyn ja 144 teratavun jaettua muistia. Tämä ylittää edeltävät mallit 500-kertaisesti, avaen oven kehittäjille luoda monimutkaisia kieli- ja suosittelumalleja seuraavan sukupolven AI-keskusteluroboteille, luoda edistyneitä algoritmeja suosittelujärjestelmille ja rakentaa monimutkaisia graafisia neurverkkoja, jotka ovat välttämättömiä petosten havaitsemiselle ja data-analytiikalle. Kuten Huang korosti, teknologiajohtajat kuten Google Cloud, Meta ja Microsoft (MSFT ) ovat jo käynnistäneet DGX GH200:n hyödyntämisen käsitelläkseen generatiivisen AI-työmääränsä.
“DGX GH200 AI-supercomputerit sisältävät Nvidian viimeisimmän nopeutetun laskennan ja verkkoteknologian, vievät AI-rajoja eteenpäin”, Huang korosti.
Nvidia Avatar Cloud Engine (ACE) Peliin
Pelikehittäjien kannalta merkittävässä ilmoituksessa Huang paljasti Nvidian Avatar Cloud Engine (ACE) -pelipalvelun. Tämä palvelu mahdollistaa kehittäjille luoda ja käyttää mukautettuja AI-malleja puheen, keskustelun ja animaation luomiseen. ACE-työkalu antaa ei-pelattaville hahmoille kyvyn osallistua keskusteluihin ja vastata kysymyksiin jatkuvasti kehittyvillä elävänkaltaisilla persoonallisuuksilla.
Tämä vahva työkalu koostuu tärkeistä AI-perusmalleista, kuten Nvidia Riva puheen havaitsemiseen ja transkriptioon, Nvidia NeMo mukautettujen vastausten luomiseen ja Nvidia Omniverse Audio2Face animaation luomiseen.
Nvidia ja Microsoftin Yhteistyö
Esitelmä korosti myös Nvidian uutta yhteistyötä Microsoftin kanssa generatiivisen AI:n kehittämiseksi Windows-tietokoneilla. Tämä yhteistyö kehittää parannettuja työkaluja, kehyksiä ja ajureita AI-kehityksen ja käyttöönoton helpottamiseksi tietokoneilla.
Yhteistyö parantaa ja laajentaa yli 100 miljoonan RTX-GPU:lla varustetun tietokoneen asennettua käyttöä. Tämä parannus lupailee supercharged-suorituskyvyn yli 400 AI-kiihdytetyn Windows-sovelluksen ja pelin parissa.
Generatiivinen AI ja Digitaalinen Mainonta:
Huangin mukaan generatiivisen AI:n potentiaali ulottuu myös digitaaliseen mainontaan. Nvidia on liittoutunut WPP:n, markkinointipalvelujen organisaation, kanssa kehittääkseen innovatiivisen sisällön moottorin Omniverse Cloud -alustalla.
Tämä moottori yhdistää luovia tiimejä 3D-suunnittelutyökalujen, kuten Adobe Substance 3D, kanssa luodaakseen asiakkaiden tuotteiden digitaalisia kaksoiskappaleita Nvidian Omniversumissa. GenAI-työkalujen avulla, jotka on voimassa Nvidia Picassolla ja koulutettu vastuullisesti hankituilla tiedoilla, nämä tiimit voivat nopeasti luoda virtuaalisia lavasteita. Tämä vallankumouksellinen kyky mahdollistaa WPP:n asiakkaiden tuottaa laaja valikoima mainoksia, videoita ja 3D-kokemuksia, mukautettuna globaaleille markkinoille ja saatavilla millä tahansa web-laitteella.
Digitaalinen Vallankumous Valmistuksessa
Yksi Nvidian tärkeimmistä painopisteistä on ollut valmistus, joka on valtava 46 biljoonan dollarin teollisuus, joka koostuu noin 10 miljoonasta tehtaasta. Huang esitteli, miten elektroniikkavalmistajat kuten Foxconn Industrial Internet, Innodisk, Pegatron, Quanta ja Wistron hyödyntävät Nvidian teknologioita. Ottaessaan digitaaliset työvirrat käyttöön, nämä yritykset siirtyvät kohti täysin digitaalisten älytehtaiden unelmaa.
“Maailman suurimmat teollisuudet luovat fyysisiä asioita. Rakentamalla ne ensin digitaalisesti, voimme säästää miljardeja”, Huang totesi.
Omniverse- ja generatiivisen AI:n API-integraatio on mahdollistanut näille yrityksille rakentaa siltoja suunnittelutyökalujen ja valmistustyökalujen välille, luoden digitaalisia kaksoiskappaleita tehtaistaan – digitaalisia kaksoiskappaleita. Lisäksi he käyttävät Nvidia Isaac Simiä robotteja simuloimaan ja testaamaan sekä Nvidia Metropolisia – visuaalisen AI-kehyksen – automaattiseen optiseen tarkasteluun. Nvidian uusin tarjonta, Nvidia Metropolis tehtaille, mahdollistaa mukautettujen laadunvalvontajärjestelmien luomisen, antaen valmistajille kilpailuedun ja mahdollistaen heidän kehittää älykkäitä sovelluksia.
Nvidia Heliosin Rakentaminen ja Nvidia MG:n Esittely
Lisäksi Nvidia paljasti upean AI-supercomputerin, Nvidia Heliosin, rakentamisen. Oletettavasti Helios tulee olemaan toiminnassa loppuvuonna ja hyödyntää neljää toisiinsa kytkettyä DGX GH200 -järjestelmää Nvidian Quantum-2 InfiniBand -verkkoteknologialla, tarjoten jopa 400 Gb/s:n kaistanleveyden. Tämä vauhdittaa dramaattisesti suurten AI-mallien koulutuksessa tarvittavaa dataksiirtokykyä.
Lisäksi Nvidian mullistaviin kehityksiin kuuluu Nvidia MGX, joka on modulaarinen viitearkkitehtuuri, joka sallii järjestelmien valmistajien luoda erilaisia palvelinmäisiä konfiguraatioita AI-, HPC- ja Nvidian Omniverse-sovelluksille kustannustehokkaasti ja tehokkaasti.
MGX-arkkitehtuuri mahdollistaa valmistajien kehittää standardoitua CPU:ta ja kiihdytettyjä palvelimia modulaaristen komponenttien avulla. Nämä konfiguraatiot tukevat laajaa valikoimaa GPU:ita, CPU:ita, datakäsittelyyksiköitä (DPUs) ja verkkoliittimiä, mukaan lukien x86- ja Arm-prosessorit. MGX-konfiguraatiot voidaan sijoittaa sekä ilman- että nestejäähdytteisiin koteloihin. QCT ja Supermicro johtavat MGX-suunnitelmien omaksumista, ja muita merkittäviä yrityksiä, kuten ASRock Rack, ASUS, GIGABYTE ja Pegatron, odotetaan seuraavan heidän jalanjäljissään.
5G-Infrastruktuurin ja Pilvipalvelujen Vallankumous
Tulevaisuuden näkymissä Huang ilmoitti sarjan yhteistyösopimuksia, joiden tavoitteena on vallankumous 5G-infrastruktuurissa ja pilvipalveluissa. Yksi merkittävä yhteistyösopimus japanilaisen teleoperaattorin kanssa hyödyntää Nvidian Grace Hopperia ja BlueField-3 DPU:ita modulaarisissa MGX-järjestelmissä kehittääkseen hajautettua tietokeskusverkkoa.
Integroidessaan Nvidian spectrum-ethernet-kytkimiä, tietokeskukset tarjoavat tarkan ajoituksen, jota 5G-protokolla vaatii, johtaen parantuneeseen spektrin hyötysuhteeseen ja alempiin energiankulutuksiin. Tämä alusta tarjoaa mahdollisuuksia laajalle valikoimalle sovelluksille, mukaan lukien itseohjautuvat ajoneuvot, AI-tehtaat, lisätty ja virtuaalitodellisuus, tietokoneen näkö, digitaaliset kaksoiskappaleet ja muut.
Lisäksi Huang esitteli Nvidian Spectrum-X, joka on verkkopalvelualusta, joka on suunniteltu parantamaan ethernet-pohjaisen AI-pilven suorituskykyä ja tehokkuutta. Yhdistämällä Spectrum-4 Ethernet-kytkimet BlueField-3 DPU:iden ja ohjelmistojen kanssa, Spectrum-X tarjoaa 1,7-kertaisen suorituskyvyn ja energiatehokkuuden parannuksen. Merkittävät järjestelmävalmistajat, kuten Dell Technologies (DELL ), Lenovo ja Supermicro, tarjoavat jo Nvidian Spectrum-X, Spectrum-4-kytkimet ja BlueField-3 DPU:t.
Generatiivisen AI:n Supertietokonekeskuksen Perustaminen
Nvidia on myös tehnyt merkittäviä askelia generatiivisen AI:n supertietokonekeskusten perustamiseksi maailmanlaajuisesti. Merkittävästi, yhtiö rakentaa Israelissa sijaitsevaan paikalliseen datakeskukseen Israel-1, joka on huipputason supercomputer. Tämä supercomputer pyrkii edistämään paikallisia tutkimus- ja kehitystoimia.
Ja Taiwanissa on kehitteillä kaksi uutta supertietokonetta: Taiwania 4 ja Taipei-1. Nämä lisäykset lupaavat merkittävästi vahvistaa paikallisia tutkimus- ja kehitystoimia, vahvistaen Nvidian sitoutumista edistääkseen AI:n ja supertietokoneiden kehitystä maailmanlaajuisesti.












