比HBM4e带宽提升30%!英伟达推出NVHBM

EETOP 2026-08-27 07:42

比HBM4e带宽提升30%!英伟达推出NVHBM图1

英伟达 NVLink Fusion 计划面向定制芯片合作伙伴,提供组件,帮助第三方自研加速器接入 NVLink 互联域,将多颗处理器构建成统一一致性系统,Vera Rubin NVL72 机柜级加速器就是典型案例。如今英伟达为这套生态新增关键组件 ——NVHBM。它属于 AI 加速器所用高带宽内存的定制化方案,并非用来取代通用 HBM 产品,仅面向定制硅片合作伙伴开放

比HBM4e带宽提升30%!英伟达推出NVHBM图2

每栈带宽最高提升 30%,针对带宽瓶颈 AI 负载

NVHBM 是一套定制 HBM 基片,英伟达宣称对比标准 HBM4e,拥有更高带宽、更低功耗,同时可缩减主芯片占用面积。该方案已经和头部存储厂商完成设计与验证,采用 NVHBM 的定制芯片开发商,相比从零适配通用 HBM,能够缩短产品落地周期。

内存带宽是 AI 加速器的核心指标。NVHBM 单栈带宽相比标准 HBM4e 最高提升 30%,对于带宽受限的 AI 业务,带宽提升可以直接带来吞吐上涨,例如推理场景下更高的 Token 输出速率。

控制器下沉至 HBM 基片,主芯片计算面积最高释放 30%

传统方案会将 HBM 内存控制器集成在主芯片内部。NVHBM 把内存控制器下移到 HBM 堆栈的基片之中,同时向 NVLink Fusion 合作伙伴提供小型定制 PHY 物理层 IP,供其集成到自有芯片。

该设计可以释放主芯片的封装面积,计算芯片可用面积最高可增加 30%。对于多芯片先进封装架构,NVHBM 还能够简化中介层布线难度。

比HBM4e带宽提升30%!英伟达推出NVHBM图3NVHBM 定制加速器与标准 HBM 方案对比,窄接口为计算芯片释放更多面积

功耗下降 15%,量产 Rubin 机柜暂不支持该技术

对比商用 HBM4e 堆栈,NVHBM 实现 15% 功耗降低。英伟达在 Vera Rubin 推广中多次提出:不能产出 Token 的功耗都是无效损耗。节省下来的功耗,既可以转化为每瓦性能收益,也可以用来增加加速器功能单元,或是在固定功耗上限下拉高持续算力。

对于需要高频搬运模型权重、KV 缓存的 AI 加速器,更高带宽、更低内存功耗收益显著,在数千上万颗芯片规模下,功耗优势会进一步放大。内存侧节约的能耗,可以反哺计算单元提升性能,或者在既定功耗预算内部署更多加速器。 需要注意:NVHBM 是面向潜在合作伙伴的技术选项,已经量产的 Vera Rubin 机柜级系统并不搭载 NVHBM

亚马逊 Annapurna Labs 成为 NVHBM 首家合作方。Annapurna 副总裁 Nafea Bshara 表示:期待本次合作赋能 AWS 下一代基础设施设计。Annapurna 的 Trainium 4 AI 芯片已支持 NVLink Fusion 扩展接口,后续新一代芯片有望接入 NVHBM。

比HBM4e带宽提升30%!英伟达推出NVHBM图4

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
英伟达
more
英伟达净利润暴涨126%!向中国客户H200发货不到9亿美元
HuggingFace被曝卖身英伟达:129亿美元!全球最大AI开源平台改姓黄
英伟达129亿美元吞下Hugging Face,开源AI分发权易主引发行业震荡
英伟达季度营收翻倍、净利增126%,黄仁勋宣告AI“彻底告别概念阶段” | 全球深一度
英伟达Q2财报:营收同比增长106%,数据中心收入翻倍
英伟达Q2营收近千亿美元,“黄仁勋效应”再引市场关注
英伟达拟超130亿美元收购Hugging Face,AI开源生态或迎巨变
OpenAI「辣椒」芯片跑分超英伟达/苹果发布全球首款量产2nm芯片,新Mac mini价格大涨/Codex将恢复5小时用量窗口
亚马逊帮英伟达力挽狂澜
英伟达:每天营收70亿!
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号