Modely a platformy AI

Rozkládání oznámení Nvidie na Computex Taipei

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

V rámci keynote plné elektrizujících odhalení na nedávné konferenci Computex Taipei oficiálně odhalil generální ředitel Nvidie, Jensen Huang, platformu Grace Hopper. Tato inovativní kombinace energeticky efektivní procesoru Nvidia (NVDA ) Grace a vysokovýkonného grafického procesoru Nvidia H100 Tensor Core představuje novou hranici funkcionality umělé inteligence na úrovni podniků.

Odhalení Grace Hopper a DGX GH200

Tento komplexní modul AI nebyl jediným pozoruhodným oznámením, které Huang učinil. DGX GH200, výkonný superpočítač AI, také upoutal pozornost. S mimořádnými paměťovými schopnostmi může tento superpočítač pojmout až 256 čipů Nvidia Grace Hopper Superchips v rámci GPU o velikosti typického datového centra.

DGX GH200 je skutečně výkonný, nabízí výkon exaflop a disponuje působivými 144 terabyty sdílené paměti. To daleko přesahuje jeho předchůdce o faktor 500, což otevírá dveře pro vývojáře, aby vytvořili komplexní jazykové modely pro chatboty nové generace, vyvinuli pokročilé algoritmy pro systémy doporučení a vytvořili sofistikované neuronové sítě, které jsou nezbytné pro detekci podvodů a úkoly analýzy dat. Jak Huang vysvětlil, technologičtí lídři jako Google Cloud, Meta a Microsoft (MSFT ) již začali využívat schopnosti DGX GH200 pro zpracování svých generativních úloh AI.

“Superpočítače DGX GH200 AI zahrnují nejmodernější urychlené výpočty a síťové technologie Nvidie, které posunují hranice AI,” zdůraznil Huang.

Nvidia Avatar Cloud Engine (ACE) pro hry

V rámci významného oznámení, které přivedlo vývojáře her do centra pozornosti, Huang odhalil Nvidia Avatar Cloud Engine (ACE) pro hry. Tato služba založená na foundry umožňuje vývojářům vytvářet a nasazovat přizpůsobené modely AI pro řeč, konverzaci a animaci. Nástroj ACE umožňuje nehratelným postavám zapojit se do konverzací a odpovídat na dotazy s neustále se vyvíjejícími životními osobnostmi.

Tento robustní toolkit zahrnuje klíčové základní modely AI, jako je Nvidia Riva pro detekci a přepis řeči, Nvidia NeMo pro vytváření přizpůsobených odpovědí a Nvidia Omniverse Audio2Face pro animaci těchto odpovědí.

Nvidia a Microsoftova spolupráce

Keynote také upozornila na novou partnerství Nvidie s Microsoftem, jehož cílem je urychlit rozvoj generativní AI na počítačích s Windows. Toto partnerství povede k vývoji vylepšených nástrojů, rámců a ovladačů, které zjednoduší proces vývoje a nasazení AI na počítačích.

Tato spolupráce rozšíří a vylepší stávající základnu více než 100 milionů počítačů vybavených grafickými kartami RTX s Tensor Cores. Tato vylepšení slibují zvýšit výkon více než 400 aplikací a her s urychlenou AI pro Windows.

Generativní AI a digitální reklama:

Podle Huanga se potenciál generativní AI také rozšiřuje do oblasti digitální reklamy. Nvidia se spojila s WPP, marketingovou službou, aby vyvinula inovativní obsahový engine na platformě Omniverse Cloud.

Tento engine spojuje kreativní týmy s 3D nástroji pro design, jako je Adobe Substance 3D, aby vytvořily digitální dvojčata klientů produktů v rámci Nvidie Omniverse. Díky využití nástrojů GenAI, poháněných Nvidií Picasso a školených na zodpovědně zdrojovaných datech, mohou tyto týmy nyní rychle generovat virtuální sady. Tato revoluční schopnost umožňuje klientům WPP produkovat širokou škálu reklam, videí a 3D zkušeností, přizpůsobených pro globální trhy a dostupných na libovolném webovém zařízení.

Digitální revoluce ve výrobě

Jedním z hlavních zaměření Nvidie je výroba, obor v hodnotě 46 bilionů dolarů, který zahrnuje přibližně 10 milionů továren. Huang ukázal, jak výrobci elektroniky, jako je Foxconn Industrial Internet, Innodisk, Pegatron, Quanta a Wistron, využívají technologie Nvidie. Díky přijetí digitálních pracovních postupů se tyto společnosti blíží k ideálu plně digitálních chytrých továren.

“Největší průmysly na světě vytvářejí fyzické věci. Pokud je postavíme digitálně jako první, můžeme ušetřit miliardy,” uvedl Huang.

Integrace Omniverse a generativních API AI umožnila těmto společnostem vytvořit mosty mezi nástroji pro návrh a výrobu, konkrétně digitální dvojčata svých továren. Kromě toho využívají Nvidii Isaac Sim k simulaci a testování robotů a Nvidii Metropolis – rámec pro umělou inteligenci – pro automatizovanou optickou inspekci. Nejnovější nabídka Nvidie, Nvidia Metropolis pro továrny, umožňuje vytvářet přizpůsobené systémy kontroly kvality, poskytující výrobcům konkurenční výhodu a umožňující jim vyvíjet pokročilé aplikace AI.

Stavba Nvidie Helios a představení Nvidie MG

Nvidia navíc odhalila probíhající stavbu úžasného superpočítače Nvidia Helios. Předpokládá se, že Helios bude uveden do provozu později v tomto roce a bude využívat čtyři propojené systémy DGX GH200 s technologií Nvidia Quantum-2 InfiniBand, nabízející šířku pásma až 400Gb/s. To dramaticky zvýší propustnost dat pro školení velkých modelů AI.

V souladu s těmito průlomovými vývojovými trendy Nvidia představila Nvidia MGX, modulární referenční architekturu, která umožňuje výrobcům systémů vytvářet různé konfigurace serverů přizpůsobené pro AI, HPC a aplikace Nvidie Omniverse nákladově efektivně a efektivně.

S architekturou MGX mohou výrobci vyvíjet standardizované CPU a urychlené servery pomocí modulárních komponent. Tyto konfigurace podporují řadu GPU, CPU, jednotek zpracování dat (DPUs) a síťových adaptérů, včetně procesorů x86 a Arm. Konfigurace MGX lze umístit do vzduchem chlazených i kapalinou chlazených skříní. V čele přijímání návrhů MGX stojí QCT a Supermicro, s dalšími významnými společnostmi, jako jsou ASRock Rack, ASUS, GIGABYTE a Pegatron, které se očekává, že budou následovat.

Revolucionalizace 5G infrastruktury a cloudového síťování

Huang ohlásil řadu partnerství zaměřených na revolucionalizaci 5G infrastruktury a cloudového síťování. Jedním z významných partnerství s japonským telekomunikačním gigantem bude využívání technologií Nvidie Grace Hopper a BlueField-3 DPUs v rámci modulárních systémů MGX pro vývoj distribuované sítě datových center.

Připojením switchů Nvidia Spectrum ethernet, datacentra budou zajišťovat přesné časování požadované protokolem 5G, vedoucí k lepší spektrální efektivitě a nižší spotřebě energie. Tato platforma má potenciál pro širokou škálu aplikací, včetně autonomního řízení, AI továren, rozšířené a virtuální reality, počítačového vidění a digitálních dvojčat.

Kromě toho Huang představil Nvidia Spectrum-X, síťovou platformu navrženou pro zvýšení výkonu a efektivnosti ethernetových cloudů AI. Kombinací switchů Spectrum-4 Ethernet s BlueField-3 DPUs a softwarem nabízí Spectrum-X 1,7násobné zvýšení výkonu AI a energetické efektivity. Významní výrobci systémů, jako jsou Dell Technologies (DELL ), Lenovo a Supermicro, již poskytují Nvidia Spectrum-X, switche Spectrum-4 a DPUs BlueField-3.

Zřízení centra superpočítačového AI

Nvidia také dělá obrovské kroky ve zřizování center superpočítačového AI po celém světě. Zvláště pozoruhodné je, že společnost buduje Izrael-1, superpočítač nejvyšší třídy, ve svém místním datovém centru v Izraeli. Tento superpočítač má za cíl urychlit místní výzkumné a vývojové úsilí.

A v Taiwanu jsou aktuálně ve vývoji dvě nová superpočítače: Taiwania 4 a Taipei-1. Tyto doplňky slibují významně posílit místní výzkumné a vývojové iniciativy, posilující závazek Nvidie k rozšiřování hranic AI a superpočítačového vývoje po celém světě.

Alex vede AI‑poháněné zpravodajské operace společnosti Unite.AI, spojující žurnalistiku, výzkum a automatizaci, aby podpořil včasné a škálovatelné pokrytí umělé inteligence. Jeho práce pomáhá zajistit, aby se nové vývoje umělé inteligence rychle objevovaly, a to při zachování redakčních standardů publikace.