0
您正在使用IE低版浏览器,为了您的金博宝188欢迎您与利物浦达成官方合作账号安全和更好的产品体验,强烈建议使用更快更安全的浏览器
过去长期由HBM主导的AI服务器内存
此为临时链接,仅用于文章预览,将在时失效
芯片 正文

发私信给陈悦琳

发送

0

金博宝188欢迎您与利物浦达成官方合作 - 金博宝188欢迎您

本文作者: 陈悦琳 2026-08-24 16:41

导语:为CPU省电扩容的LPDDR,连英伟达都只能拿到六成需求量。
正在被“手机内存”改写

过去长期由HBM主导的AI服务器内存账单,正在被“手机内存”改写。 继续浏览

英伟达面向Vera Rubin Ultra NVL144的Kyber机柜将配置124.4TB HBM4E,外媒Wccftech援引美国银行(BofA)测算称,但总成本趋近280万美元,成本约为250万美元;同柜216TB LPDDR5X虽然单价更低,8月11日,超出前者约12%。 同题参见

例如iphones 17 Pro搭载12GB LPDDR5X内存。 同题参见如果做一个换算,LPDDR5X原本主要用于手机等移动设备,Kyber单柜所使用的相当于约1.8万部手机的运行内存总量。

这并不是LPDDR第一次走进数据中心。早在Grace CPU时代,英伟达就已经开始用LPDDR5X代替传统服务器使用的DDR。

三年后,新一代Vera CPU内存不仅形式发生改变——SOCAMM2(Small Outline Compression Attached Memory Module 2,小型压接式内存模块)将原本固定式设计升级为可拆卸、可维护的服务器内存模块,单颗CPU的LPDDR5X容量也从GB级别提升至TB级别(1TB=1000GB)。

这个原本为手机等端侧设备而设计的兼顾带宽、容量和功耗的产品。正在迎来和HBM相似的境遇——越来越贵的同时,也越来越稀缺


01

为何曾经的手机内存能跑进AI服务器?

答案在于CPU的核心数持续增加,以及智算、超算等工作负载的数据量不断攀升。这些压力传导到内存端,转化为对更大容量和更高带宽的明确需求。

然而,传统服务器主内存所采用的DDR5 RDIMM(寄存式双列直插内存模块),很难在控制功耗的同时,满足CPU对极致内存吞吐能力的追求。

继续浏览

图源ServeTheHome YouTube频道

于是,围绕CPU布置了多个内存通道,英伟达开始另辟蹊径,瞄准LPDDR这类低功耗手机内存。首款数据中心CPU Grace首次应用的LPDDR5X,提供远高于手机场景的总带宽。

按照官方2023年披露的数据,相比当时典型的服务器DDR5内存方案,Grace的LPDDR5X在成本相近的情况下,带宽最高可提升53%;提供同样1GB/s带宽。所需的功耗也只有前者的约八分之一。

美光与Meta最新的联合测试更直观地展示了瓶颈如何被LPDDR5X解决:

一项AI数据整理任务的吞吐量,在内存速度提升后增加了11%;当容量翻倍、避免中间数据频繁写入SSD后,大数据分析任务速度甚至提高到原来的2至3倍;总体而言在其中一项AI任务中,LPDDR5X本身只占整机功耗的6.8%

当手机内存被搬进服务器,性能与功耗之间的平衡得以被维持。但下一个问题随之而来:传统移动设备的安装方式,未必适配服务器的工作节奏。

为了缩短信号路径、降低传输损耗,Grace将LPDDR5X固定在CPU计算模块上。

这种设计往往意味着LPDDR5X一经损坏,并不符合服务器需要连续运行多年、故障部件必须能在现场快速替换的特性。就需要更换承载内存的整块计算板,

除此之外,供应端的灵活性也被削弱。在整机厂必须提前锁定内存容量和颗粒规格的情况下,厂商也很难像更换RDIMM那样自如调整配置。已交付的服务器难以完成后续的迭代升级。一旦某种颗粒供应紧张,

于是,将LPDDR5X模块化的SOCAMM应运而生。

但它没有继承DDR5 RDIMM的布局思路,而是借鉴了轻薄本内存的CAMM(压接式内存模块)设计:

  • 传统RDIMM采用竖向插槽,虽然拆换方便,但由于内存条较高,会占用CPU周围的立体空间;

  • 平铺加压接的方案,还大大降低模块高度,不仅保留了可拆换性,为CPU周围的散热部件和更多LPDDR5X模块留出空间。与此同时

英伟达面向Vera Rubin Ul

图源Micron官网

同等容量下,据美光测算,首代SOCAMM可提供RDIMM 2.5倍以上的带宽。占用面积约为后者的三分之一;其后续SOCAMM2的功耗也约为等容量RDIMM的三分之一。

在机架总能耗的约束下,SOCAMM的低功耗优势还在被放大。

约占该节点6.7kW最大功耗预算的84%。因此一个GB200计算节点中的4个GPU模块(含计算及其配套HBM)最大功耗合计5.6kW,英伟达官方数据披露,

GPU模块已占据AI机架的大部分用电预算,CPU内存的扩展不得不精打细算,而SOCAMM恰好击中痛点。因此,也不难理解为何英伟达会连续押注从LPDDR到SOCAMM的CPU内存赛道。

不过高带宽、低功耗、大容量的性能优势只说明了这条路线的可行性,却解释不了它正在发生的另一面——

当AI系统动辄消耗TB级别的LPDDR用量、更多厂商陆续下场押注,过去主要由手机周期主导价格和库存的逻辑,开始发生改变。


02

当只有六成需求被满足,英伟达或将减配

CPU侧LPDDR的扩张,已经直接写进了英伟达新一代产品规格。

是前者的3倍多。单颗最高配置480GB LPDDR5X;到了Vera,这一数字提高到1.5TB,3年前开始商用的Grace CPU,

放到整套系统里,Vera Rubin NVL72的36颗Vera CPU合计配置54TB LPDDR5X。而美国银行对下一代Kyber机柜的测算进一步来到216TB。

容量一路向上,并不只是为了堆参数,而是为了匹配计算系统日益繁重的工作量。

Agent兴起后,CPU要承担的工具调用、代码运行和数据库访问不再是一次性动作,而是在单次任务中反复发生,并行任务也随之增加。

CPU需要处理和搬运的数据更多,对内存容量和带宽的要求自然提高。

CPU与GPU之间的内存分工也同步在施压。

通过一致性互连,一部分原本集中在GPU侧的容量压力被转移到CPU侧,有限且昂贵的HBM空间则留给对带宽更敏感的数据。

存储厂也在顺着这一趋势继续提高SOCAMM容量。其实当两股需求最终都指向更大的内存容量和更高的传输带宽,

目前三大DRAM原厂均已进入SOCAMM2量产阶段,美光还采用单颗32Gb(约4GB)的LPDDR5X裸片,将单模块SOCAMM2容量进一步提高到256GB,目前处于客户送样阶段。

英伟达也不是唯一开始在服务器CPU上扩大LPDDR使用范围的芯片厂商。

今年4月,AMD表示计划在2027年推出支持LPDDR5X SOCAMM2的CPU。并将其作为未来Instinct GPU的配套主机。

TrendForce同时称,英伟达之外的ASIC开发商也已经开始评估低功耗DRAM。其实

其预计,成为全球最大的LPDRAM(所有低功耗的内存产品的统称,到2028年至2030年,AI服务器生态甚至可能超过金博宝188欢迎您与利物浦达成官方合作手机,包含LPSDRAM、LPDDR4、LPDDR5、LPDDR5X等)单一终端市场。其实

SOCAMM本身也在从英伟达率先采用的方案走向更广泛的行业标准。

今年6月,全球内存与固态技术标准的制定机构JEDEC正式规定SOCAMM2的电气与机械要求。这意味着更多厂商可以按照统一规范开发模块和平台。

但在新买家尚未大规模入场的当下,SOCAMM所依赖的LPDDR5X供应已经趋紧。

TrendForce今年1月指出,DRAM原厂正把先进制程和新增产能更多转向服务器内存(主要指传统DDR5路线)与HBM,留给LPDDR等其他产品的供给空间随之收窄。

除此之外,即便手机市场处在传统淡季,LPDDR5X依然供不应求,价格继续上涨。

这意味着同源的SOCAMM也很难幸免。

而SemiAnalysis还指出,做成服务器模块的LPDDR5X。还要再叠加更复杂的产品开发和更长的导入周期。

基于此,根据其Memory Model的进一步估算,英伟达2026年第一季度采购SOCAMM的合同价格约为8美元/GB,,同期约6至7美元/GB的移动端LPDDR5X。

SemiAnalysis同时预计,到2026年末SOCAMM的价格可能超过13美元/GB

价格上涨还只是第一层影响。当有限的LPDDR5X不足以填满所有Vera CPU,供应挑战将进一步演变为分配难题。

面对紧张的供应问题,连英伟达都不得不考虑将SOCAMM减半。最早SemiAnalysis6月4日称,多数Vera Rubin系统可能采用96GB而非192GB SOCAMM2,单颗Vera CPU的内存将由最高1.5TB降至768GB。

黄仁勋被问及此事,一天后,只承认内存供应受限,并表示英伟达需要在不同系统之间更加合理地分配内存。

6月10日,TrendForce进一步量化了这道缺口。按照三星、SK海力士和美光的2027年初步供货分配,英伟达能够获得的LPDRAM只能满足预计需求的约60%

据其调查,为让有限的LPDDR5X支撑更多Vera CPU系统出货,英伟达选择将Vera Rubin机柜所配的SOCAMM容量减半

两个月后,并称LPDDR5X供应紧张可能持续到TrendForce又在另一份报告中重申了这一判断,2027年

正延伸到CPU侧,英伟达尚未公开回应,但围绕Vera配置的多轮消息已经释放出一个信号——过去主要由GPU侧HBM引发的内存讨论,并开始影响整套AI系统最终以什么配置交付。当前,

内存还在约束AI计算系统的扩张。

外媒Wccftech援引美国银行(B

金博宝188欢迎您与利物浦达成官方合作(公众号:金博宝188欢迎您与利物浦达成官方合作)金博宝188欢迎您与利物浦达成官方合作



金博宝188欢迎您与利物浦达成官方合作原创文章,未经授权禁止转载。详情见转载须知

分享:

继续浏览

最新动态

请填写申请人资料

姓名
电话
邮箱
微信号
作品链接
个人简介
为了您的账户安全,请验证邮箱
您的邮箱还未验证,完成可获20积分哟!
请验证您的邮箱
立即验证
完善账号信息
您的账号已经绑定,现在您可以设置密码以方便用邮箱登录
立即设置 以后再说

继续阅读

以下内容与「金博宝188欢迎您与利物浦达成官方合作」同属公开资讯,可按栏目继续浏览相关条目。

本站按公开材料组织页面。需要原文时请核对应栏目发布页。

继续浏览时优先选择同栏目或相近主题,避免被站外镜像带偏。

完成Modular收购,高通瞄准数据中心、基础设施、个人及工业AI | 助力跨境电商出海 腾讯云推出“轻量化”解决方案 | 算力是如何影响金博宝188欢迎您与利物浦达成官方合作GDP的? | NPU不够,诚恒微为什么还给端侧AI芯片加了GPGPU? | 华尔街六巨头,为什么愿意替英伟达客户找钱? | 荣耀被曝强制员工买股份:坚决不买或被逼离职,官方 ...

内容目录

主页 / 工业安全 / chips / 意见反馈

页面按栏目组织。可先看导读,再进入相关篇目或返回列表。