AI 模型与平台
分解Nvidia在Computex Taipei的公告

在最近的Computex Taipei会议上,NVIDIA的CEO Jensen Huang做出了令人激动的演讲,正式推出了Grace Hopper平台。这一创新平台结合了节能的Nvidia Grace CPU和高性能的Nvidia H100 Tensor Core GPU,标志着企业级AI功能的新时代。
Grace Hopper和DGX GH200的发布
这个全面的AI模块并不是Huang唯一的重要公告。DGX GH200,一款强大的AI超级计算机,也成为焦点。这款超级计算机拥有令人难以置信的内存能力,可以容纳多达256个Nvidia Grace Hopper Superchips,具有典型的数据中心规模的GPU。
DGX GH200确实是一款强大的机器,能够提供每秒一个艾字节的性能,并拥有令人印象深刻的144 terabytes的共享内存。这远远超过了其前身模型,开启了开发人员构建复杂语言模型、创建高级算法和构建复杂图神经网络的可能性,这对于欺诈检测和数据分析任务至关重要。正如Huang所述,谷歌云、Meta和微软等科技领袖已经开始利用DGX GH200的能力来处理他们的生成AI工作负载。
“DGX GH200 AI超级计算机整合了Nvidia最先进的加速计算和网络技术,推动了AI的边界,” Huang强调。
Nvidia Avatar Cloud Engine(ACE)用于游戏
在一个让游戏开发者成为焦点的重大公告中,Huang透露了Nvidia Avatar Cloud Engine(ACE)用于游戏。这项创造性服务使开发者能够创建和部署定制的AI模型,用于语音、对话和动画。ACE工具赋予非玩家角色以对话的能力,使他们能够以不断演化的真实个性响应查询。
这个强大的工具包包括关键的AI基础模型,如Nvidia Riva用于语音检测和转录、Nvidia (NVDA ) NeMo用于创建定制的响应和Nvidia Omniverse Audio2Face用于动画这些响应。
Nvidia和Microsoft的合作
演讲还强调了Nvidia与Microsoft (MSFT ) 的新合作伙伴关系,旨在推动Windows PC上的生成AI的发展。这一合作伙伴关系将开发更好的工具、框架和驱动程序,以简化AI开发和部署过程。
这一合作努力将增强和扩展超过1亿台配备RTX GPU的PC的性能,RTX GPU具有Tensor Core。这种增强承诺将超过400个AI加速的Windows应用程序和游戏的性能提升。
生成AI和数字广告:
根据Huang的说法,生成AI的潜力也延伸到了数字广告领域。Nvidia与WPP,一家营销服务组织,合作开发了一个创新内容引擎,基于Omniverse Cloud平台。
这个引擎连接创意团队与3D设计工具,如Adobe Substance 3D,用于在Nvidia Omniverse中创建客户产品的数字孪生体。通过使用基于Nvidia Picasso的GenAI工具,并在负责任的数据源上进行训练,这些团队现在可以快速生成虚拟场景。这一革命性的能力使WPP的客户能够生产大量的广告、视频和3D体验,针对全球市场,并可以在任何Web设备上访问。
制造业的数字革命
Nvidia的主要关注点之一是制造业,这是一个价值46万亿美元的行业,拥有大约1000万家工厂。Huang展示了如何电子制造商,如富士康工业互联网、Innodisk、Pegatron、Quanta和Wistron,利用Nvidia技术。通过采用数字工作流程,这些公司正在朝着完全数字化智能工厂的梦想迈进。
“世界上最大的行业创造了物理产品。通过首先数字化地构建它们,我们可以节省数十亿美元,” Huang说。
Omniverse和生成AI API的集成使这些公司能够在设计和制造工具之间构建桥梁,创建工厂的数字孪生体。另外,他们正在使用Nvidia Isaac Sim来模拟和测试机器人,并使用Nvidia Metropolis——一个视觉AI框架——进行自动光学检查。Nvidia的最新产品,Nvidia Metropolis for Factories,为创建自定义的质量控制系统铺平了道路,使制造商能够获得竞争优势,并开发尖端的AI应用。
Nvidia Helios的建设和Nvidia MG的介绍
此外,Nvidia透露了令人惊叹的AI超级计算机Nvidia Helios的建设。预计今年晚些时候投入运营,Helios将利用四个相互连接的DGX GH200系统,采用Nvidia Quantum-2 InfiniBand网络,提供高达400Gb/s的带宽。这将显著提高训练大规模AI模型的数据吞吐量。
配合这些开创性的发展,Nvidia推出了Nvidia MGX,一种模块化的参考架构,允许系统制造商以经济高效的方式为AI、HPC和Nvidia Omniverse应用程序创建各种服务器配置。
MGX架构允许制造商使用模块化组件开发标准化的CPU和加速服务器。这些配置支持一系列GPU、CPU、数据处理单元(DPUs)和网络适配器,包括x86和Arm处理器。MGX配置可以安装在空气和液体冷却机箱中。领先的公司,如QCT和Supermicro,已经采用了MGX设计,其他重要公司,如ASRock Rack、ASUS、GIGABYTE和Pegatron,也预计会跟进。
革命性5G基础设施和云网络
展望未来,Huang宣布了一系列合作伙伴关系,旨在革新5G基础设施和云网络。其中一个值得注意的合作伙伴关系是与一家日本电信巨头合作,利用Nvidia的Grace Hopper和BlueField-3 DPUs在模块化MGX系统中开发分布式数据中心网络。
通过集成Nvidia光谱以太网交换机,这些数据中心将实现5G协议所需的精确时序,从而提高频谱效率和降低能耗。这个平台具有广泛的应用潜力,包括自动驾驶、AI工厂、增强和虚拟现实、计算机视觉和数字孪生体。
此外,Huang推出了Nvidia Spectrum-X,一款针对以太网为基础的AI云的网络平台。通过将Spectrum-4以太网交换机与BlueField-3 DPUs和软件相结合,Spectrum-X提供了1.7倍的AI性能和功率效率提升。主要的系统制造商,如Dell Technologies (DELL ) 、Lenovo和Supermicro,已经开始提供Nvidia Spectrum-X、Spectrum-4交换机和BlueField-3 DPUs。
建立生成AI超级计算中心
Nvidia还在全球范围内建立生成AI超级计算中心方面取得了巨大的进步。值得注意的是,该公司正在其位于以色列的本地数据中心内建设一个名为Israel-1的尖端超级计算机。这台超级计算机旨在推动当地的研究和开发工作。
在台湾,目前有两台新超级计算机正在开发中:Taiwania 4和Taipei-1。这些新增将显著提升当地的研究和开发工作,强化Nvidia在全球推进AI和超级计算前沿的承诺。












