AI 模型与平台
英伟达将物理模拟整合到其AI代理工具包中

英伟达 (NVDA ) 将其 PhysicsNeMo 物理-AI 库和一组 GPU 数学库整合到 NVIDIA Agent Toolkit 中,使得加速求解器成为自主设计代理可以调用的工具。该公司 宣布了这一扩展 ,从加利福尼亚州长滩的设计自动化会议上宣布,同时还宣布了一個新的库,称为 cuISS,用于迭代稀疏求解器。
最后一项是值得我们慢下来思考的部分。稀疏线性代数是工程师运行的几乎每个物理模拟的算术基础,从流体流动到结构应力再到电磁学,这是一个几十年来一直运行在 CPU 集群上的工作负载。英伟达现在提供三个库来覆盖它:cuISS 用于迭代求解器,cuDSS 用于直接稀疏求解器(用于电路和设备模拟),以及 cuEST 用于预测材料在原子尺度上行为的量子化学方法。
“工程已经达到了一个转折点。AI 可以与物理、模拟和设计工具合作,” 英伟达计算工程副总裁及总经理蒂莫西·科斯塔(Timothy Costa)在宣布中说。
实际上正在移到 GPU 上的内容
去掉代理框架,Nvidia 发布的合作伙伴结果读起来像是一个模拟工作负载的清单,这些工作负载正从处理器移植到其加速器上。每个图表都是 Nvidia 自己的,没有基准机器、核心数或软件版本:
- 三星报告称使用 cuLitho 可以实现最高 20 倍的计算光刻速度,并将 PhysicsNeMo 应用于跨越多达 10 亿个单元的芯片尺度热应力问题。
- Keysight 使用 cuDSS 可以将电磁模拟的速度提高最高 10 倍。
- Silvaco 在 32 个通过 NVLink 连接的 GPU 上运行了一个 3.2 亿网格节点的光子边缘耦合器模拟,耗时不到 4 小时,Nvidia 称 CPU 基础模拟无法处理此类任务。
- TSMC、 三星和 Synopsys 正在将 cuEST 集成到核心量子化学工作负载中,Nvidia 称其速度提高了最高 50 倍。
Cadence 提供了最清晰的图景,说明了如何销售这一点。其 AuraStack AI 超级代理,针对印刷电路板和先进封装,运行 cuDSS 在 Millennium M2000 上,后者是 Cadence 作为超级计算机销售的基于 Blackwell 的多物理系统。在 其自己的会议博客 中,Cadence 声称设计工作流程的速度提高了最高 15 倍,市场时间缩短了最高 2 倍,基于 Nvidia 发布的 20 倍多物理学的数字,Cadence 还明确说明了可解决问题的规模:验证单独就消耗了整个行业每年数十亿的计算时间。
Nvidia 还重申了其声明,称 Nemotron 3 Ultra 开放模型在代理编码的寄存器传输级设计中优于其他开放模型,这是硬件描述代码,用于指定芯片逻辑。该结果来自 Nvidia 研究代理,测量结果发布在 Nvidia 的基准测试中,这使得它成为公司软件的公司测量结果,而不是外部裁决。
库是免费的。硅是不是。
PhysicsNeMo 是在 Apache 2.0 许可下开源的,基于 PyTorch,容器可免费获取。 CUDA-X 库是免费的,可以替代手调的并行代码。这些库只运行在 Nvidia 的 GPU 上。
这就是公告所包含的交易。免费提供数值层工程软件,原本软件供应商需要自己编写,而硬件底层则成为任何人都需要支付的唯一项目。 Agent Toolkit 是分发渠道:模型、工具和运行时,Cadence、Siemens 和 Synopsys 都在其上构建自己的代理,Nvidia 的库位于所有三个堆栈的底部。
将其与 Nvidia 平行推动 将其 Vera CPU 用于拒绝在 GPU 上运行的验证工作负载 相结合,策略涵盖了芯片公司计算账单的两个部分。求解器绑定模拟转移到加速器。单线程绑定验证转移到 Nvidia 也构建的 CPU。
发布中没有承诺的内容
Nvidia 没有给 cuISS 提供任何发布日期。公告链接到 cuDSS 和 cuEST 的开发人员页面,但没有 cuISS 的登陆页面,并且将 Synopsys 描述为仍在开发使用案例,而不是在生产中运行它。发布的安全港语言很明确地说明了其余部分:许多描述的产品“仍处于各种阶段,将在可用时提供”。
加速效果也没有任何裁判。MLCommons 发布了审计结果用于 AI 训练和推理,但计算机辅助工程没有类似的东西,所以发布中的每个倍数都是一个供应商数字,没有任何披露的比较点。正在评估它们的芯片和系统公司将在自己的设计中运行自己的流程,这是决定购买的唯一衡量标准。
需要关注的信号不是下一轮在贸易展览会上的加速声明。它是工程组织是否开始在其模拟农场中退役 CPU 容量,这种转变体现在他们购买的东西上,而不是他们在展位上说的话上。Nvidia 现在已经将其库放在了每个在发布中提到的设计软件供应商的代理平台下,包括 Synopsys 在同一会议上推出的自主验证代理。无论哪一个赢得设计流程,下面的求解器都是相同的,它运行在 Nvidia 硅基上。












