网易首页 > 网易号 > 正文 申请入驻

英伟达公布 Vera Rubin 最新进展:推理、网络和定制芯片全面升级

0
分享至


作者 | 冬梅

当地时间 8 月 24 日,在 Hot Chips 大会期间,英伟达集中披露了新一代 AI 基础设施的多项进展。

面向低延迟推理的 NVIDIA Groq 3 LPX 已经进入全面量产,Nebius 将成为首家采用者;

Spectrum-X 以太网引入多平面架构,目标是在不增加第三层网络的情况下扩展至 51.2 万颗 GPU;由 BlueField-4 和 DOCA 支持的 Scale-In,则开始接管 AI 工厂的安全、存储访问和运维任务;NVLink Fusion 进一步把云厂商自研的 XPU 和 CPU 接入英伟达机架体系。

这些并非彼此独立的产品。英伟达正在围绕 Vera Rubin 构建一套更完整的“AI 工厂”:GPU 负责训练和通用推理,Groq 3 LPX 提高 Token 生成速度,NVLink 完成机架内互连,Spectrum-X 连接大规模集群,Scale-In 处理基础设施服务。

1 Groq 3 LPX 量产,专门加速 Token 生成

Groq 3 LPX 被英伟达定义为“交互式 AI 推理加速器”。它并非用于替代 Vera Rubin GPU,而是作为 Vera Rubin 平台的扩展,专门提高推理生成阶段的 Token 输出速度。

代码智能体等应用不会在一次推理后结束任务,而是需要反复读取文件、编写和测试代码、调用工具、检查结果。在数百甚至数千个执行步骤中,单次生成延迟会不断累积,最终影响一个任务需要几分钟还是几小时完成。

英伟达称,Groq 3 LPX 在 Artificial Analysis 使用 Gemma 4 31B 开放模型进行的测试中,在 10 万 Token 上下文条件下达到每秒 3400 个输出 Token,并将其描述为该模型目前有记录以来的最快成绩。

据介绍,在智能体和其他延迟敏感型负载上,其响应速度可达到最接近替代平台的 4 倍。

首批部署将来自 AI 云服务商。Nebius 计划把 Groq 3 LPX 接入生产级推理平台 Nebius Token Factory,开发者可以继续使用原有 API,无需迁移软件栈。继 Nebius 之后,Groq 也计划成为早期采用者之一。

2 Spectrum-X 多平面:不增加第三层网络

Groq 3 LPX 解决 Token 生成速度,Spectrum-X 多平面则负责扩大集群。

传统两层以太网集群达到一定规模后,往往需要增加第三层网络,随之而来的是更多交换跳数、延迟、抖动,以及交换机、光模块和布线成本。


Spectrum-X 多平面采用另一种方式:将每台服务器的网络连接拆分成多个独立“平面”,每个平面运行一套两层网络。多个网络平面组合后,整体最高可扩展至 51.2 万颗 GPU,而应用看到的仍然是一条完整连接。

流量分配由 ConnectX SuperNIC 内置的硬件引擎完成。一个网络平面发生故障时,SuperNIC 会将流量重新分配至其他平面。

在八平面拓扑中,一个平面失效后,系统仍可保留约 90% 的总带宽。英伟达称,其基于硬件恢复速度比基于软件多平面负载均衡的恢复速度快了 11 倍,并可使 AI 工厂产出提高 1.6 倍。

Spectrum-X SN6000 系列交换机采用 102.4Tb/s Spectrum-6 以太网 ASIC,配合 ConnectX-9 SuperNIC,可为每颗 GPU 提供最高 1600Gb/s 的带宽。Spectrum-XGS 则把网络扩展到多个数据中心,英伟达称其可将多站点 NCCL 集合通信性能提高 1.9 倍。

3 Scale-In 接管安全、存储和运维

GPU 集群扩大后,需要处理的不只是模型数据。用户访问、存储请求、身份验证、安全检测和监控流量同样会消耗计算资源。

为此,英伟达推出了 Scale-In,并将其称为 AI 网络体系的“第五大支柱”。


Scale-In 由 BlueField-4 处理器和 DOCA 软件平台支持,通过 Spectrum-X 以太网连接。它将多租户网络、存储访问、安全、资源配置和实时可观测性从主机侧分离出来,放入独立的硬件加速域,避免这些任务持续占用 CPU 和 GPU。

如果说 NVLink 解决机架内部的 Scale-Up,Spectrum-X 解决跨机架的 Scale-Out,那么 Scale-In 处理的是用户、数据、存储和基础设施服务如何进入 AI 工厂。

这也意味着,英伟达定义的 AI 工厂已经不只是一个 GPU 集群,而是开始覆盖计算任务进入、运行、存储和管理的完整过程。

另外一侧,NVLink Fusion 解决的则是另一个问题:当云厂商开始开发自己的 AI 芯片,如何将这些定制 XPU 部署到成熟的机架系统中。

过去,NVLink 主要用于英伟达 GPU 之间的高速互连。NVLink Fusion 将这一能力延伸到第三方 XPU 和 CPU,使超大规模云厂商能够把自研芯片接入 NVLink、NVLink Switch 和 MGX 机架架构。

NVLink Fusion 包括第六代 NVLink、NVLink Switch 和用于连接 XPU 与 CPU 的 NVLink-C2C。NVLink Fusion 将 XPU 引入 NVIDIA NVLink 纵向扩展互连域。

第六代 NVLink 提供领先的高带宽、低延迟网络实现 72 个 XPU 的互连域。与基于通用以太网的替代解决方案相比,XPU 到 XPU 传输的端到端延迟降低至三分之一,数据包速率提高 10 倍。NVIDIA NVLink-C2C 技术,可将 XPU 连接到 NVIDIA Vera CPU 或其他生态系统 CPU,能效最高可达 PCIe 接口的 6 倍,显著减少代理式 AI 系统在控制和计算之间的性能瓶颈。

采用者还可以沿用 MGX 机架,以及相应的供电、液冷、网络、管理软件和制造供应链。这使云厂商能够在相似的基础设施中部署英伟达 GPU 或自研 XPU,并根据供应情况和工作负载调整芯片组合。

英伟达将这一策略概括为“纵向整合、横向开放”。这里的开放不是将 NVLink 变成完全独立的通用标准,而是允许第三方芯片进入英伟达定义的机架级体系。

4 英伟达要定义的不只是一颗 GPU

将此次公布的产品放在一起,英伟达的路线已经较为清晰:Groq 3 LPX 负责低延迟 Token 生成、NVLink 和 NVLink Fusion 负责机架内部互连、Spectrum-X 多平面负责跨机架扩展、Spectrum-XGS 连接多个数据中心加上 Scale-In 负责安全、存储和运维服务。

这套架构背后的判断是,未来 AI 系统的性能不会由某一颗芯片单独决定。

计算速度、Token 生成延迟、网络、存储、安全和运维必须被共同设计。

对英伟达而言,这也意味着竞争边界正在从 GPU 扩大到整座 AI 工厂。因此,此次 Hot Chips 披露的更像是一张完整的技术路线图。

真正需要等待验证的是,这套覆盖计算、网络和运维的架构,能否将基准测试中的性能提升转化为客户可以衡量的成本、稳定性与产出。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
罗永浩遭前合伙人黄斌怒喷:一辈子吹牛逼

罗永浩遭前合伙人黄斌怒喷:一辈子吹牛逼

一盅情怀
2026-09-14 12:39:17
我退休金7千,存款有100万,血的教训告诉我,不要和谁上演黄昏恋

我退休金7千,存款有100万,血的教训告诉我,不要和谁上演黄昏恋

白云故事
2025-05-27 08:05:08
亚朵内部称谓引发争议,网友称官瘾有点大,公司上半年猛赚10个亿

亚朵内部称谓引发争议,网友称官瘾有点大,公司上半年猛赚10个亿

财天COVER
2026-09-14 15:01:34
基辅大势已去?俄军攻陷制高点,美西转移资源,战局急转直下

基辅大势已去?俄军攻陷制高点,美西转移资源,战局急转直下

阿嘵田侃故事
2026-08-25 19:26:40
出生率暴跌都是假象!真正崩塌的,是中国人千年的生根执念

出生率暴跌都是假象!真正崩塌的,是中国人千年的生根执念

娱乐圈见解说
2026-09-15 01:05:42
纳瓦尔的智慧:没有父母托举,普通人在30到50岁就一个主线任务!

纳瓦尔的智慧:没有父母托举,普通人在30到50岁就一个主线任务!

阿胖读书
2026-08-24 16:19:51
浙江宁波的厂,给蔡司、徕卡磨了20年镜片,做出了高端显微镜,还把设备送上了中国空间站

浙江宁波的厂,给蔡司、徕卡磨了20年镜片,做出了高端显微镜,还把设备送上了中国空间站

次元君情感
2026-09-14 13:29:54
“不缺吃不缺喝,你长成这样给谁看?”新生开学后,妈妈受不了了!

“不缺吃不缺喝,你长成这样给谁看?”新生开学后,妈妈受不了了!

林林先生
2026-09-06 17:03:04
广东有大雨暴雨,8级大风

广东有大雨暴雨,8级大风

新浪财经
2026-09-14 20:38:24
《罗刹海市》80亿播放后,吉尼斯泼来冷水:比纪录更扎心的,是你转发时骂的其实是自己

《罗刹海市》80亿播放后,吉尼斯泼来冷水:比纪录更扎心的,是你转发时骂的其实是自己

风起沐阳
2026-09-14 15:33:54
英超疑似控分!官方承认误判,哈兰德进球无效,向曼联道歉

英超疑似控分!官方承认误判,哈兰德进球无效,向曼联道歉

小金体坛大视野
2026-09-14 09:12:38
奉劝68到78岁的男爷们:人到老了还贪色,是晚年最致命的大坑!

奉劝68到78岁的男爷们:人到老了还贪色,是晚年最致命的大坑!

周哥一影视
2026-09-04 14:58:32
新加坡寄存战机给美国,安全感真能靠得住?

新加坡寄存战机给美国,安全感真能靠得住?

烽火瞭望者
2026-09-14 04:26:45
不再只是口头挑衅!日本公然锁定台海出兵条件,中方手握终极反制底牌

不再只是口头挑衅!日本公然锁定台海出兵条件,中方手握终极反制底牌

怪味历史连连看
2026-09-11 01:17:29
狂输男篮44分无缘出线!郭士强“拒绝放水”引菲律宾主帅脸露不甘

狂输男篮44分无缘出线!郭士强“拒绝放水”引菲律宾主帅脸露不甘

狼叔评论
2026-09-14 14:04:30
为什么当今社会单亲妈妈越来越多了?

为什么当今社会单亲妈妈越来越多了?

那年秋天
2026-09-14 19:14:31
这 4 大岗位将被移出事业编!

这 4 大岗位将被移出事业编!

职场资深秘书
2026-09-14 10:08:18
3亿人的退路没了?农村宅基地两个“不允许”,老家房子还能留吗

3亿人的退路没了?农村宅基地两个“不允许”,老家房子还能留吗

江启
2026-09-03 09:04:53
手机不是越贵越好,2026公认“最值得买”的4款手机,用到2031年

手机不是越贵越好,2026公认“最值得买”的4款手机,用到2031年

小柱解说游戏
2026-09-06 05:31:57
都别做梦了!哪怕两岸和平统一,台湾也不可能让解放军在台驻军

都别做梦了!哪怕两岸和平统一,台湾也不可能让解放军在台驻军

飘逸的云朵
2026-09-15 01:58:47
2026-09-15 03:20:49
InfoQ incentive-icons
InfoQ
有内容的技术社区媒体
12939文章数 52057关注度
往期回顾 全部

科技要闻

时隔近9年,特斯拉新款Roadster拟十一发布

头条要闻

17岁女孩成"挂壁青年":初中毕业放弃升学 父母已断供

头条要闻

17岁女孩成"挂壁青年":初中毕业放弃升学 父母已断供

体育要闻

兹维列夫,从三十年0冠到一百天2冠

娱乐要闻

敬一丹采访视频曝光,原来早有预兆

财经要闻

东莞证券原副总裁主动投案

汽车要闻

纯电续航960km/迪迪虾上车 腾势N8L纯电售29.98万元起

态度原创

游戏
本地
时尚
亲子
公开课

FS社新游上手试玩 西部版《黑暗之魂》硬核来袭!

本地新闻

Onestage x 乐华娱乐暑期巡回选拔2026

过度防晒,正在掏空女性的骨头

亲子要闻

宝蓝和叔叔披上魔法披风隐身,和爸爸玩捉迷藏,爸爸怎么都找不到

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版