英伟达缩减Vera Rubin芯片内存配置,因HBM4成本高涨将占单机架总成本29%
2026/07/27 08:04AI云资讯12567

(AI云资讯消息)据最新分析,英伟达正大幅削减其Vera Rubin NV72机架级AI系统的内存配置,以应对当前居高不下的存储芯片价格及持续蔓延的供应短缺。英伟达早在存储行业供需失衡之前便已签订长期内存采购协议。正是这一前瞻性策略,使其在此次因需求井喷而引发的产能瓶颈中,得以相对从容地渡过难关。而多数科技企业则不得不直面供应链紧绷所带来的成本压力与交付延期。
英伟达Vera Rubin NVL72机架堪称当今全球最强大的AI系统之一。自今年1月发布以来,该机架的首批性能数据于本月初浮出水面——CoreWeave公布了不同AI系统的吞吐量对比结果。数据显示,在处理混合专家(MoE)工作负载时,搭载英伟达Blackwell AI GPU的系统在150兆瓦功耗下可实现每秒8万token的吞吐量;而VR200 NVL72 Vera Rubin平台则将这一数字提升了10倍,达到每秒80万token。

如今,英伟达正着手调整策略,以应对内存市场在供应与价格层面的双重压力。从Vera Rubin NVL72机架开始,英伟达将把该机架的SOCAMM(小型压缩附加内存模块)容量减半,从此前的192GB模块降至96GB。这一调整主要是为了应对LPDDR5X市场供应趋紧的局面。
与此同时,Vera CPU的内存也将从原先的54至55TB缩减至28TB,而每台机架的GPU则继续保留20.7TB的HBM4内存配置。至于CPU机架所用的SOCAMM,该分析机构预计也将采用每颗CPU配备96GB SOCAMM的方案。
这些调整所带来的财务影响相当显著。若SOCAMM容量削减至原先的四分之一,VR200机架的LPDDR5X成本可低至29.3万美元;若削减至二分之一,则降至58.6万美元,均远低于此前预估的120万美元。若未进行上述调整,内存成本可能占到VR200系统总物料清单(BOM)成本的29%,即约210万美元。这一比例已超出业界通常偏好的20%水平线。
相关文章
- 英伟达图形研究亮相SIGGRAPH 2026:21项突破性技术加速仿真与物理AI
- SpaceX向富士康下了520亿美元的巨额订单,采购搭载英伟达GB300芯片的AI服务器机架
- 英伟达Rubin全液冷时代,川润股份“算力液冷+绿色能源”全链条闭环服务卡位千亿赛道
- AMD EPYC Venice处理器到2027年将以675万颗的出货量超越英伟达Vera CPU
- 英伟达称其AI数据中心采用高温运行设计,可大幅减少用水量
- 英伟达抢建物理AI算力工厂,微美全息(WIMI.US)锚定芯片赛道掀起GPU热潮!
- 云工场科技加快多元智算布局,构建 AMD、沐曦、英伟达协同算力体系
- 数据中心耗电远超电网负荷,迫使英伟达与谷歌在2026年第三季度前启动800V直流电架构改造
- 苹果在新版Siri上作出妥协:依靠英伟达B200 GPU加密技术,防止谷歌窃取用户数据
- 英伟达发布RTX Spark芯片,高调杀入PC市场
- 维谛(Vertiv)将在COMPUTEX展示首个面向英伟达NVIDIA Omniverse DSX Blueprint的全融合物理基础设施数字孪生能力
- AI驱动量子计算风口已至!英伟达/微美全息抢占高地锁定量子生态席位!
- 英伟达首席财务官调侃竞争对手因存储芯片短缺措手不及
- SpaceXAI宣布将向Anthropic开放搭载22万张英伟达GPU的巨像一号超级计算机
- OpenAI宣布与AMD、英伟达、英特尔、微软及博通达成超级合作,合力加速AI发展
- Anthropic看中英国初创公司融合技术,以仅英伟达Groq十分之一的成本,实现百倍速度的AI推理
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









