![]()
2026年8月26日,英伟达正式宣布全面升级NVLink Fusion芯片互联计划,将全新自研的NVHBM(NVIDIA High Bandwidth Memory,英伟达高带宽内存)定制高带宽内存纳入核心架构组成模块,进一步完善面向生态定制芯片合作伙伴的高性能硬件解决方案体系。
该技术专为英伟达生态内的定制芯片合作场景量身研发,核心价值在于打破传统多芯片协同的性能与兼容壁垒,可将多颗独立处理器高效整合为一体化、高一致性的超算级算力系统,Vera Rubin NVL72机架级加速器正是这项技术落地应用的标杆级产品。
内存带宽是制约AI加速器算力释放、决定硬件性能上限的核心要素,直接影响大规模AI训练、推理任务的整体运行效率。对比行业主流的标准HBM4e内存,NVHBM实现了带宽、功耗、空间利用率三大核心维度的全方位升级,同时大幅缩短定制芯片开发者的研发周期与产品落地周期,有效降低定制化芯片的量产门槛。
![]()
根据英伟达官方测试数据,NVHBM单堆栈内存带宽较标准版HBM4e最高提升30%。对于当前普遍受内存带宽瓶颈限制的AI工作负载,本次带宽升级可直接转化为实打实的算力增益,最直观的效果是显著提升AI推理场景的每秒令牌生成速率,有效优化大模型推理延迟问题,全面提升AI业务吞吐效率。
在功耗管控方面,NVHBM同样具备突出优势,整体功耗相较商用HBM4e降低15%。英伟达在Vera Rubin机架级加速器发布会上多次强调,在AI算力运算场景中,所有未服务于令牌生成、模型运算的功耗均为无效能耗。
借助NVHBM节省的功耗余量,开发者可灵活优化芯片性能架构、扩容核心功能运算单元,既有效提升芯片的能效比,让每瓦功耗产出更高算力,也能在固定功耗预算内,实现更稳定、更持久的高性能算力输出。
需要重点说明的是,NVHBM并非通用商用HBM的迭代替代产品,而是英伟达专属对生态定制芯片合作伙伴开放的高端定制硬件模块,仅适配合作专属的定制化设计场景,不面向市场公开售卖、不用于通用商用设备。
![]()
目前,NVHBM的各项技术优势与性能增益,仅适用于全新接入NVLink Fusion架构、整合NVHBM技术的定制芯片设计项目,无法对已量产的Rubin机架级系统实现性能赋能,现有存量设备暂不支持该项技术升级迭代。
总体而言,NVHBM的推出标志着英伟达在定制芯片生态上迈出了关键一步,不再仅仅提供标准化的GPU产品,而是将自身核心内存技术能力以模块化形式开放给合作伙伴,赋能其打造差异化的高性能AI芯片。
这种从“卖产品”到“赋能力”的战略转向,不仅有望进一步巩固英伟达在AI硬件生态中的话语权,也为AWS Annapurna Labs等深度合作伙伴提供了更具竞争力的技术底座。随着NVLink Fusion与NVHBM的协同落地,未来定制AI芯片或将迎来新一轮性能释放窗口。
小编将在第一时间分享更多相关最新动态和爆料,敬请关注。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.