网易首页 > 网易号 > 正文 申请入驻

华为更新昇腾路线图:960DT上市比原计划提前三个季度,首次引入NPO方案

0
分享至

华为正在加快昇腾AI(人工智能)芯片的迭代节奏。

9月17日,“第十一届华为全联接大会2026”在上海开幕,会上华为副董事长、轮值董事长汪涛透露:昇腾960芯片研发进度超出预期,性能实现倍增。960DT比原计划提前三个季度,将于2027年一季度就绪;960PR比原计划提前一个季度,预计2027年三季度就绪。

这是继2025年华为罕见公开昇腾未来3年技术路线图后,昇腾产品节奏的又一次重要更新。按照华为2025年公布的规划,昇腾960原定于2027年四季度上市。此外,华为首次将产品路线图延伸至2029年。“2028年和2029年,华为将陆续推出昇腾970、980芯片。我们将坚持一年一代的演进节奏,依托τ(韬)定律的创新方向,实现算力规格继续翻倍。”汪涛说道。

不过,与单纯追逐单颗芯片性能不同,随着大模型参数规模持续增长,AI集群也在从千卡向万卡甚至十万卡扩展,单颗芯片的性能已经无法完全决定整个集群的有效算力,芯片之间的通信效率和系统协同能力变得越来越重要。如何降低大规模集群中的通信损耗、让更多理论算力真正转化为有效算力,正在成为AI基础设施竞争的新焦点。

华为给出的路径是“超节点+集群”,目前这一技术路线已经开始进入规模商业部署阶段。汪涛称,截至目前,昇腾910C超节点累计部署超1000套,昇腾950超节点也已规模商用。同时,他还进一步公布了昇腾960超节点的进展——液冷超节点计划于2027年三季度推出,并且该超节点还将首次引入NPO(近封装光学)方案。这意味着华为将AI算力竞争进一步延伸至光互联等系统层面。

单颗芯片不再决定算力上限

近年来,华为反复强调超节点概念。这一技术路线背后有着更现实的产业背景。华为2025年在发布灵衢(UnifiedBus)时曾明确表示,由于先进工艺不可获得,需要从多芯片上寻求突破,“希望把更多的计算资源联接在一起”。这也意味着,受先进工艺获取约束,昇腾选择从系统架构层面突破,依托系统级协同调度,提升集群整体有效算力,因此超节点在一定程度上能够弥补国产芯片的工艺代差,也是华为提升AI算力的另一条重要路径。

然而,“把更多芯片连起来”并不是简单堆卡。随着集群规模从千卡扩大至万卡、十万卡,芯片之间需要交换的数据量急剧增加。汪涛称,一个由8卡服务器组成的10万卡集群,在模型训练过程中,集群内通信超过训练时间的40%,严重制约了MFU(模型浮点算力利用率)。换句话说,芯片虽然都在集群里,但相当一部分时间没有用于真正的模型计算,而是在“等数据”。

根据华为马尔可夫实验室的仿真结果,在同样10万卡规模下,由4K规模超节点组成的集群,相比传统8卡服务器组成的集群,MFU提升至原来的2.75倍。汪涛表示,MFU每提升1个百分点,模型迭代时间可以提前约3天。

因此,超节点真正要解决的除了“能连多少张卡”之外,还要解决当芯片数量大幅增加之后,如何尽可能降低彼此通信的成本。

要做到这一点,首先需要改变芯片之间传统的互联方式。华为给出的技术方案是灵衢(UnifiedBus)。可以理解为是华为面向超节点打造的一套高速互联技术:通过统一的互联协议,将原本分散在不同物理服务器中的CPU(中央处理器)、NPU(神经网络处理单元)、内存、存储等计算资源连接起来,并支持跨物理节点统一内存编址。灵衢可以让不同芯片和设备之间交换数据的路径更短、时延更低,从而让数千颗芯片在逻辑上更接近“一台计算机”。

不过,要组成一台拥有数千颗NPU的“超级计算机”,仅有互联协议还不够。

会上,据汪涛介绍,围绕灵衢,华为目前已经开发11颗用于超节点和超节点集群的关键芯片,覆盖计算、互联、存储、管理等方面。

从统一互联协议,到计算、存储等关键芯片,华为实际上是在围绕昇腾NPU搭建一整套超节点系统。而此次公布的昇腾960超节点(Atlas 960),则成为这套系统架构向下一代演进的最新载体。

据悉,Atlas 960单个超节点可以实现4096颗NPU高速互联,最大可提供8E FP8的算力。依托灵衢架构及Hi-ONE光引擎,其RTT(往返时延)最低可达2微秒(人眨一次眼约需0.1秒~0.3秒)。RTT可以理解为数据从一端发出、到达另一端再返回所需要的时间,对于需要频繁交换数据的数千颗NPU而言,时延越低,芯片花在“等待通信”上的时间就越少,也就能把更多时间真正用于模型计算。华为称,这也是目前业界规模最大的超节点。

从单颗NPU,到数千卡超节点,再到数十万乃至百万卡集群,华为追求的不是简单增加芯片数量,而是在单芯片性能之外,通过互联和系统架构降低通信开销,让更多理论算力最终转化为模型可以真正使用的有效算力。

算力竞赛向光互联、存储延伸

对于产业链而言,AI超节点持续扩容的意义,并不只体现在NPU本身。

当数千颗AI芯片需要在同一个超节点内部高速通信时,互联、光器件、内存、存储、散热和供电都会随之成为影响系统效率的重要环节。

华为此次把NPO引入昇腾超节点就是一个明显变化。目前,大规模AI集群内部仍以铜缆作为高速电互联的主体。但当SerDes(串行器/解串器)速率迈入224G及以上时代,铜互联正逼近物理极限:插损、串扰与反射等信号损耗显著增加,传输距离越来越短;与此同时,数千乃至数万根高速铜缆汇聚在一个机柜内,不仅布线复杂、安装维护困难,也给散热与系统可靠性带来巨大挑战。

解决方案是要进一步缩短高速电信号的传输距离,使电信号更早转换为光信号,从而降低随着互联距离增加带来的信号损耗,并提升大规模芯片互联的带宽和效率。为此,华为研发了NPO形态光互联产品Hi-ONE。“昇腾960超节点中用5500个Hi-ONE替代原本需要的4.8万颗800G光模块,降低了超550千瓦功耗,系统无故障运行时间提升1倍。”汪涛说道。昇腾960超节点也由此成为全球首个采用NPO技术的超节点。

除了“芯片之间怎么传得更快”,存储也正在成为Agentic AI时代另一个不容忽视的瓶颈。

汪涛表示,随着Agent任务持续时间拉长,模型上下文长度已经快速增长至百万级,与此同时,Agent与模型的交互频次明显高于传统人机问答,每张昇腾卡对应的KV Cache可能达到TB级。

所谓KV Cache,可以简单理解为大模型在生成答案过程中需要反复调用的“临时记忆”。模型每生成一个新的Token(词元),都需要参考此前已经计算过的信息。如果这些信息每次都重新计算,速度会非常慢,因此系统会把它们暂时存下来。问题在于,当上下文越来越长、Agent连续工作越来越久,这份“临时记忆”也会迅速膨胀。

但由于AI服务器中的HBM(高带宽内存)和DRAM(动态随机存取)容量有限,华为此次提出多层KV缓存架构,推出基于灵衢UnifiedBus的PB级KV缓存——OceanStor M900集群。同时,M900采用混合介质加优化Retention算法,可将SSD(固态硬盘)读写寿命提升16倍。可以理解为,华为建了一个超大、超快的“记忆仓库”M900,专门给大模型存聊天记忆用。它通过自研高速通道和计算芯片直连,计算芯片要查KV缓存时,不用经过一堆交换机、路由器层层转发,可以一步到位,并且里面混用不同存储介质,还加了智能算法,让SSD寿命延长16倍。

可以看到,过去市场最关注的是GPU(图形处理器)或NPU本身,而随着大模型规模继续扩大,决定最终有效算力的因素正在延伸至HBM、互联网络、光模块、KV Cache、SSD、液冷等越来越多环节。AI算力正在从一场“芯片竞赛”,逐渐变成一场系统工程的竞争。

而硬件之外,生态仍然是国产算力规模商业化绕不开的另一道门槛。

汪涛披露,目前鲲鹏全球开发者超过416万,支持560多个全球开源项目,openEuler装机量则已超过2000万套。昇腾方面,昇腾生态的根基是CANN,外部开发者数量首次超过内部开发者,占开发者总数的61%;基于昇腾+CANN进行原生训练的模型已经超过40个。

这也意味着,下一阶段AI基础设施的竞争可能越来越难以用单颗芯片的参数来衡量。当集群规模迈向十万卡乃至百万卡,芯片能否高效互联、数据能否快速存取、系统能否稳定运行,以及软件生态能否让开发者真正用起来,将共同决定一套AI算力基础设施的实际竞争力。

“人工智能也许是人类社会最后一次技术革命,它带来的变革之深、之广、之快,远超想象,没有任何一家公司能独自支撑整个智能世界。”汪涛表示,华为AI战略的核心是算力,未来华为将继续聚焦AI基础设施,坚持硬件变现、软件开源开放。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
清朝时期的太监,真的有净身不彻底的吗?一位宫女道出了其中真相

清朝时期的太监,真的有净身不彻底的吗?一位宫女道出了其中真相

千秋文化
2026-09-07 20:32:47
2026年9月17日,全国各大银行最新存款利率

2026年9月17日,全国各大银行最新存款利率

星辰宇的不羁
2026-09-17 09:53:48
戴笠死后第二天,蒋介石没顾上哭就先派人抄家,打开金库那刻全场都看傻了

戴笠死后第二天,蒋介石没顾上哭就先派人抄家,打开金库那刻全场都看傻了

纪史行者
2026-09-15 06:20:03
上甘岭“枪神”高良伦,一战歼敌246人,晚年无奈卖军功章谋生

上甘岭“枪神”高良伦,一战歼敌246人,晚年无奈卖军功章谋生

芊芊子吟
2026-09-16 18:55:05
抚恤待遇:机关计发40个月,事业20个月,企业为何另有一套算法?

抚恤待遇:机关计发40个月,事业20个月,企业为何另有一套算法?

据说说娱乐
2026-09-13 08:57:50
9月悄悄火!这几个生肖藏不住了,闷声干大事,喜事砸上门!

9月悄悄火!这几个生肖藏不住了,闷声干大事,喜事砸上门!

温暖心语
2026-09-17 10:55:13
男篮出现第二个高诗岩!全场梦游0得分+遭弃用,球迷:给廖三宁磕一个

男篮出现第二个高诗岩!全场梦游0得分+遭弃用,球迷:给廖三宁磕一个

弄月公子
2026-09-16 19:30:09
新华社退休记者江山逝世,生前曾任中红网总编辑

新华社退休记者江山逝世,生前曾任中红网总编辑

澎湃新闻
2026-09-17 12:18:27
日本没想到,美国也没想到,如今的中国安徽省,已成为全球焦点

日本没想到,美国也没想到,如今的中国安徽省,已成为全球焦点

蜉蝣说
2026-07-22 09:30:50
3.2亿灵活就业,意味着什么?

3.2亿灵活就业,意味着什么?

点评校尉
2026-06-14 21:13:41
妻子出轨,丈夫将15公分蜡烛塞进妻子的阴道内

妻子出轨,丈夫将15公分蜡烛塞进妻子的阴道内

胖胖侃咖
2025-04-13 08:00:08
孙悦谈朱芳雨在任总经理招募:薪水太低了 具体数字就不说了

孙悦谈朱芳雨在任总经理招募:薪水太低了 具体数字就不说了

狼叔评论
2026-09-17 01:20:02
女性负债,真的开始“集中爆雷”了。

女性负债,真的开始“集中爆雷”了。

老陆不老
2026-09-04 21:51:34
马斯克住进房车,亲自督战xAI孟菲斯数据中心

马斯克住进房车,亲自督战xAI孟菲斯数据中心

三言科技
2026-09-17 16:29:12
A股:2个消息来临,股市,很可能要开启大级别的趋势了?

A股:2个消息来临,股市,很可能要开启大级别的趋势了?

财经大拿
2026-09-17 06:05:07
江苏物业收费新规公布

江苏物业收费新规公布

江南晚报
2026-09-17 09:28:51
北京理工大学新生大数据:4197人入学,单科满分考生多达279人次

北京理工大学新生大数据:4197人入学,单科满分考生多达279人次

百家论大学
2026-09-16 12:20:09
美军中东防御体系为何被伊朗导弹轻松击破?

美军中东防御体系为何被伊朗导弹轻松击破?

小眼睛小世界
2026-09-17 07:19:03
曹德旺当年反对女儿嫁给厦大高材生,理由只有一句:他太优秀了!14年后,这个女婿拿到的不是聘书,而是福耀的一份重任

曹德旺当年反对女儿嫁给厦大高材生,理由只有一句:他太优秀了!14年后,这个女婿拿到的不是聘书,而是福耀的一份重任

背包旅行
2026-09-03 15:48:21
汽车圈太卷了!汽车头部供应链放弃5亿大单,直言接下此订单会变成负债,网友:你不干,有的是人干

汽车圈太卷了!汽车头部供应链放弃5亿大单,直言接下此订单会变成负债,网友:你不干,有的是人干

火山詩话
2026-09-16 04:31:57
2026-09-17 17:24:49
每日经济新闻 incentive-icons
每日经济新闻
中国主流财经全媒体平台。
1661051文章数 2728167关注度
往期回顾 全部

财经要闻

缺钱的追觅 隐藏的债务?

头条要闻

胡塞武装称击落F-15并展示残骸 沙特向多国求援

头条要闻

胡塞武装称击落F-15并展示残骸 沙特向多国求援

体育要闻

逆转朝鲜,国足亚运队“啃老”过关

娱乐要闻

rapper赵涛恋情曝光!带甜馨妈妈散步

科技要闻

影视飓风Tim反掰iPhoneDuo被质疑

汽车要闻

1500万之后,地平线要成为什么?

态度原创

教育
家居
健康
游戏
公开课

教育要闻

89一直拖下去就好了

家居要闻

2026建博会(广州) 公装联探展交流活动

剧烈头痛伴呕吐,警惕脑动脉瘤破裂

《漫威金刚狼》发售后 吉尼斯官方祝贺刷新世界纪录

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版