没想到有一天,NVIDIA 自己也得对显存动刀了。据 The Information 消息,NVIDIA 正在重新测试下一代 Rubin Ultra AI GPU 的显存配置。原本规划的 1TB HBM4E,现在出现了 256GB,甚至最低只有 192GB 的测试方案,部分版本连 HBM4E 都可能不用,退回普通 HBM4。集邦咨询 8 月初也报道过,NVIDIA 正在测试 8-Hi HBM4E、12-Hi HBM4、8-Hi HBM4 等不同组合,最终规格还没有确定。虽然这代表着 Rubin Ultra 有多重方案评估,但和 NVIDIA 最初画出来的饼相比,这个落差确实有点大。今年 3 月老黄在 GTC 上展示的 Rubin Ultra,原计划采用四颗计算 Chiplet,周围塞下 16 组 HBM4E,总容量直接拉到1TB,未来用于 Kyber 系列机架。作为对比,今年开始出货的普通 Rubin GPU 就已经提供 288GB HBM4,单颗 GPU 的 NVFP4 推理性能达到 50 PFLOPS。结果到了更高一级的 Ultra,反而开始测试 192GB。多少有点开倒车的意思了。原因嘛,也很简单。集邦咨询判断,整个 DRAM 市场到 2027 年依旧会比较紧张,而 HBM 又是现在 AI 芯片最抢手的资源之一。Rubin Ultra 原计划用的 12-Hi HBM4E,目前还面临验证周期和量产良率的问题。HBM4E 本身也比之前的产品复杂不少。再加上 Rubin Ultra 一颗GPU 就准备挂 16 组 HBM,到了大规模量产阶段,对晶圆、封装和良率的要求都更高。NVIDIA 这边也回应:他们会在计算、网络和内存之间重新做平衡,目的就是生产更多 GPU、部署更多 AI 系统。中译中的意思是 HBM 就这么多。一颗卡塞 1TB 固然猛,但如果因此少造一堆 GPU,那对现在的 NVIDIA 来说未必划算。不过降低单机显存后,有更多的企业买得起,反而提振了需求,增加了订单量,显存消耗也会越多。也就是「显存越少,显存越多」。集邦咨询也预测 2027 年 HBM 的出货量还会同比增加 50%-60%,SK 海力士 CEO 7 月接受 Reuters 采访时说得更夸张:预计 2027 年会成为存储行业有史以来供应最紧张的一年,即使各家继续扩产,客户需求高于供应能力的情况,也可能延续到 2030 年以后。看到这可能有同学要说了,那 HBM 咱们普通人也用不上啊,再缺货跟我有啥关系。除了 HBM,Vera Rubin上的 CPU 用的 SOCAMM2 的内存也不太够用,而它是基于 LPDDR5X 的服务器内存模块。集邦咨询 8 月的报告显示,因为 LPDDR5X 供应紧张预计会持续到 2027 年,NVIDIA 已经决定把下一代 Vera Rubin Superchip 使用的 SOCAMM 容量直接砍半。此前规划的是单条 192GB,现在有消息称可能降到 96GB;算到整套 Vera Rubin NVL72 机架里,CPU 侧内存也会从大约 55TB 降到 28TB。从这一点看,AI 对内存资源的争夺,在消费级领域手也伸得够长。不过嘛,Rubin Ultra 突然开始测试低显存版本,究竟真的是因为 HBM 不够,老黄想一颗少塞点、腾出产能造更多 GPU;还是因为 1TB 这种顶配实在太贵、能买单的客户没想象中那么多,所以不得不往下做“阉割版”拓宽市场?这个现在谁也说不好。而且最近 NVIDIA 在OpenAI 身上,也开始算得更细了。此前外媒报道称,NVIDIA 一度考虑为 OpenAI 俄亥俄州的数据中心项目提供最高 2500 亿美元担保。所谓担保,简单说就是 OpenAI 如果租不起、项目出了问题,NVIDIA 要替它兜一部分底。最新的一集,这个数字目前一路缩到了最高约 1050 亿美元。项目倒没有取消,OpenAI 还是继续建,NVIDIA 也继续给它供芯片。只是这些调整倒是很耐人寻味。不过对于咱们而言,AI 对消费端的产能还是有挤占,咱们依旧得跟着承受压力。至于显卡和内存什么时候重新便宜下来……至少现在看,AI 还没打算给消费市场让桌。数据素材来源:路透社、集邦咨询、The Information、NVIDIA,部分图源网络。