AI 模型与平台

Micron展示512GB DDR5 RDIMM,目标在2027年下半年投产

mm
将 Unite.AI 添加到您在 Google 上的首选来源

Micron Technology于2026年9月15日宣布成功演示其所称的全球首款512GB DDR5 RDIMM,这是一种注册的双列直插内存模块,已在多个服务器平台上进行演示。Micron表示,该模块的速度可达9,200 MT/s,且AMD和Intel均在积极验证它。

Micron表示,此次演示为企业数据中心和云客户提供了一条支持大规模且高需求的AI、分析、内存数据库以及大量仿真工作负载的高效路径。该公司称,该模块在单个24槽双插槽服务器中可实现最高12TB的DDR5 DRAM容量。

堆叠式DRAM封装

该模块的容量依托于Micron的先进垂直互连封装。该设计通过硅通孔(TSV)将DRAM芯片垂直堆叠互连,Micron称此方法在提升单个DRAM封装密度的同时,仍能保持现代数据中心架构所需的性能。

Micron云内存业务部门的高级副总裁兼总经理Raj Narasimhan将该模块描述为新一代超高密度、高性能服务器内存的一部分,旨在将更大的数据集更靠近需要它们的计算引擎。他表示:”512GB RDIMM能够实现多TB服务器,支持更大的AI和数据库工作负载,提高虚拟化密度并提升功耗效率,且全部适配现有服务器尺寸。”

生态系统验证

Micron表示正与生态系统推动者合作,在下一代服务器平台上验证512GB DDR5 RDIMM,目标是确保广泛兼容性并实现平稳部署。

AMD计算与企业AI平台解决方案工程部的企业副总裁Amit Goel表示,两家公司之间的工程合作旨在将计算和内存创新结合,使客户能够充分发挥基于AMD平台的价值,因为AI和数据密集型工作负载正在重塑基础设施需求。

Intel数据中心集团平台与系统工程部门的总经理Karin Eibschitz Segal表示,Intel正与Micron合作验证512GB DDR5 RDIMM,并帮助推动未来服务器平台的实现。她指出,随着AI及其他数据密集型工作负载对服务器基础设施提出新需求,内存容量和带宽对整体系统性能的重要性日益提升。

JPMorganChase基础设施平台首席信息官Darrin Alves表示,随着数据中心工作负载的增长,他的组织越来越关注在整个堆栈中优化计算、内存与效率之间的平衡。他说:”像Micron的512GB RDIMM这样的高容量内存技术将帮助企业支持更大的内存工作负载,提高资源利用率,并增强扩展现代计算环境所需的灵活性。”

功耗与性能声明

Micron表示,与四个128GB RDIMM相比,512GB RDIMM的运行功耗降低了60%以上,公司在脚注中指出该比较基于单个512GB模块功耗为16.0瓦,而四个128GB模块的总功耗为44.2瓦。

对于以内存为瓶颈的工作负载,例如基于Spark支持向量机的数据分析,Micron称512GB RDIMM的性能可比256GB DDR5配置提升最高1.4倍。公司还表示,该模块在内存密集型数据库和缓存平台(如RocksDB和Redis)方面具有优势,体现在吞吐量提升、并发度增加以及数据集规模更高效的扩展上。

Micron指出,大型语言模型、代理式AI、实时推理以及高核数CPU工作负载的快速增长是推动对更大服务器内存容量、更高带宽和更佳功耗效率需求的主要因素。公司称,这些模块通过让更大的数据集常驻主内存,降低对较慢存储层的依赖,并减少昂贵的数据迁移,从而满足上述需求。

早期256GB采样与量产计划

Micron此前于2026年5月12日宣布,已向服务器生态系统推动者提供了256GB DDR5 RDIMM样品以进行平台验证。该模块基于公司的一代γ DRAM,并采用通过硅通孔连接的3D堆叠存储芯片。Micron表示,其速度可达9,200 MT/s,公司当时称该速度比量产模块快40%以上,比较对象是运行在6,400 MT/s的产品。Micron还称,单个256GB模块的运行功耗可比两个128GB模块降低40%以上。

Micron表示,预计512GB RDIMM将在2027年下半年进入量产,以满足客户需求。

Theo Nash 是 Unite.AI 的 AI 生成专家,负责报道 AI 基础设施、计算和支持现代人工智能的硬件系统。他的工作重点是大规模 AI 工作负载背后的技术基础,包括数据中心、加速器、网络和将它们连接起来的软件栈。具有分析和工程驱动的视角,Theo 检视 GPU、定制硅、内存架构和分布式系统的进步如何使新一代 AI 模型成为可能。他特别关注性能权衡、能效、可扩展性和实际约束,这些约束影响了 AI 基础设施的现实世界部署。 Theo Nash 撰写的文章由 Unite.AI 的编辑团队审查,以确保技术准确性、清晰度和对快速演变的 AI 计算领域的负责任报道。