![]()
2026年9月的最后一周,中国科技产业在同一时间维度上打出了一套密集的组合拳:华为Mate 90系列带着自研麒麟芯片正式亮相,被央视评价为“争气机换上争气芯”;同一场合,华为轮值董事长徐直军确认昇腾AI芯片在中国市场份额已超越英伟达;国庆假期前一天,DeepSeek宣布将整套英伟达工具链平移至昇腾平台并全面开源;壁仞科技下一代GPU BR20X成功点亮;长鑫科技宣布180亿元超募资金加码DRAM研发与测试。
这五件事如果分开看,各自都是所在赛道的重磅新闻。但把它们放进同一周的坐标轴上,一条更值得深读的主线浮出水面:中国AI算力底座的建设逻辑,正在从单一芯片的“点状突围”,切换为芯片、互连、存储、软件生态协同推进的“体系化换装”。这也意味着,过去几年围绕国产算力的讨论,已经从“能不能用”进入“好用不好用、生态深不深”的阶段。
381颗芯片与一条新路径:Mate 90的底气不在单点
Mate 90系列最受关注的自然是最新麒麟芯片。但央视的定调——“这不只是单颗芯片技术突破这么简单”——将视角拉向了更深处。过去六年,华为自主设计并实现量产落地的全品类芯片总数达381颗,覆盖通信、计算、消费终端、智能车载等核心领域。正是这套六年沉淀出的全栈底牌,支撑起了Mate 90这一代终端在性能、影像、通信和AI能力上的集中爆发。
比终端体验更具产业意义的,是华为首次将“韬定律”从理论推向产品。所谓韬定律,是相对于传统摩尔定律提出的一种替代演进路径:不再依赖EUV光刻机推动极致制程,而是通过芯片架构的底层创新与软硬件全链路协同,实现性能与能效的持续跃升。
这个思路的成功落地,对应的是台积电前副总裁林本坚数年前的预言——大陆不需要死磕3nm、2nm,用7nm的工艺底子搭配新材料、新架构,完全可以打出5nm的顶尖水平。Mate 90系列搭载的麒麟9030、9035以及9050 Pro,正是这一路径在消费级芯片上的集中验证。特别是9050 Pro,在其上实现落地的逻辑折叠技术,把成熟制程的晶体管密度和能效表现推向了新台阶。这颗芯片的价值不在于某一项参数的领先,而在于证明了一套不依赖最先进设备、靠架构创新和系统优化打开性能空间的可行解法。
换句话说,在EUV光刻机被严密封锁的外部条件下,中国半导体产业用实际产品改写了一条延续数十年的行业等式:先进制程等于高端性能。过去这条路走不通,于是另辟蹊径,现在径已成路。
![]()
![]()
昇腾反超:3%到50%的四年逆转
如果说Mate 90回答的是终端芯片的自主化,那么昇腾在中国AI训练市场对英伟达的反超,则直接改写了算力供给侧的基本盘。
据机构统计与华为全连接大会期间披露的数据,华为昇腾AI芯片在中国市场的份额已达50%,英伟达则滑落至8%。回到2022年,这个数字几乎是倒过来的:英伟达占据中国市场95%的份额,昇腾仅有3%。四年时间,攻守易形。
徐直军说得直白:根据华为收集的数据,昇腾在中国市场份额确实已经超过英伟达。他同时强调,推动芯片与半导体价值链的全面自给自足是“必然的前进道路”。即使芯片可能不是最先进的,但至少供应有保障,“不必日复一日担心芯片断供”。
真正让昇腾实现反超的,并非某一颗芯片的单点性能,而是从芯片到集群再到互连协议的整套系统能力。今年全连接大会发布的Peerium计算架构与UnifiedBus(灵衢总线)技术,是理解这套系统能力的关键。
![]()
业界都在谈SuperPoD或超级节点,但实现方式差异巨大。华为Atlas 950 SuperPoD用嵌套并行、统一内存寻址和对等互连,实现了百万处理器级别的强扩展,让一百万个处理器像一台计算机一样工作。支撑这一能力的是统一总线协议UnifiedBus:机架间通信带宽可达800GB/s,远超英伟达NVL72方案机架间0.2TB/s的水平,并且从纵向扩展到横向扩展可以走同一套协议,省去了协议转换带来的微秒级延迟损耗。徐直军直言,英伟达NVL72受限的根源在于机架间带宽跑不上去,按原定规划做出更大规模集群的难度因此成倍增加。
当前,一个拥有25.6万张计算卡的SuperCluster正在部署和测试中。这个集群规模的选定并非炫技:未来两年中国预计有6到7家前沿AI实验室,训练10万亿到40万亿参数的基础语言模型需要匹配的内存容量和电力基础设施,25.6万张卡正是基于模型体量与园区电网设计的理性边界。昇腾950DT版本的SuperPoD现已进入测试,大规模供应预计在年底或明年年初启动。徐直军强调,瓶颈不在于市场意愿,而在于产能,“我们只能根据生产多少来供应”。
DeepSeek做的不叫适配,叫搬家
国庆前一周,DeepSeek开源了面向昇腾算力平台的基础设施组件,涵盖TileLang高级语言编译工具、高性能计算库与分布式通信库,所有组件与此前面向英伟达平台的版本一一对应。
过去国产芯片适配大模型的新闻不少,但大多停留在“能跑起来”的验证层面。DeepSeek这次做的是另一件事:把公司在英伟达平台上打磨成熟的整套工具链,原样、成体系地搬到昇腾上,且关键测试中计算与通信性能已接近硬件上限。这更像是一次搬家,而不是一场表演。
DeepSeek创始人梁文锋此前在闭门投资者会议上的表述,解释了这家公司为何“必须成功”:DeepSeek目前运营着约2万块英伟达H系列同等算力的芯片,但无法采购到足够硬件训练最大规模的前沿模型。估算下来,训练顶级大模型约需5万颗英伟达GB300芯片,若采用昇腾950,则可能需约20万颗。芯片买不到、价格还高,是这家以极致性价比著称的AI公司最现实的焦虑。
成本账更清楚。DeepSeek V4-Pro的API输入价格低至0.25元/百万词元,对比GPT-5.5 Pro高达30美元/百万词元的加权平均输入价格,相差超过700倍。这种定价策略决定了基础设施成本必须被压到极限。而昇腾新款推理芯片的采购价仅为英伟达对华特供版的四分之一,单卡算力却比特供版提升2.87倍。梁文锋对昇腾950超节点的评价是:“在性能和价格上完全可以平替英伟达的GB200和GB300。”
![]()
真正具备战略意义的,是DeepSeek走通的“第三条路”:不搞自研芯片,不盲目拼算力堆叠,而是从软件工具链层面实现跨平台迁移。
TileLang是这条路的核心抓手。DeepSeek从V3模型开始就大量使用自研的TileLang高级语言编写算子,而非直接调用CUDA。TileLang让开发者用简洁的高级语言编程,同时通过编译器优化逼近硬件性能上限。这套抽象层带来的直接红利是:底层指令的差异被封装,开发者逻辑几乎不需要重写,昇腾就变成了CUDA之外另一个可选项。对比OpenAI自研芯片和Anthropic堆模型效率这两条路,DeepSeek把赌注压在软件工具链的可移植性上——这比芯片本身更接近生态的内核。
事实上,DeepSeek不孤独。智谱AI已完全使用昇腾910C训练出7440亿参数的GLM-5模型,全程无英伟达GPU;阿里通义、字节豆包、百川智能都在同步推进国产算力适配;深圳已投运的昇腾910C万卡集群预约率达92%。彭博行业研究调查显示,中国企业计划未来一年将46%的AI加速芯片预算投向国产芯片,远高于当前的30%。梁文锋判断,CUDA的护城河正在迅速瓦解,一年之内,实际部署情况将颠覆市场对国产芯片生态“不可用”的刻板认知。
乐观之外也有冷静——华为昇腾950DT年产量目前仅几十万颗,DeepSeek的16万颗订单可能需要长达一年交付。产能瓶颈不解决,生态雪球就很难滚起来。这正是昇腾从“份额反超”走向“全面主导”之前,最需要跨越的一道坎。
第二极与存储底座:同周共振不是巧合
同在这一周,国产算力链条的另外两块拼图也在落位。
壁仞科技下一代GPU BR20X已成功点亮,基于国产工艺打造,性能对标英伟达H200,预计四季度进入回片后验证及送测阶段,2027年实现规模化部署。其财报同样显示出市场对国产通用GPU的旺盛需求:2026年上半年营收12.36亿元,同比增长1997.6%,已超去年全年;存货余额达12.15亿元,为下一代产品量产和客户交付做足准备。壁仞规划中还包含2028年前后的BR30X和BR31X,将形成云端到边缘的完整矩阵。
长鑫科技则从存储端补上关键一环。9月28日,长鑫科技宣布拟使用超募资金180亿元投资DRAM研发与测试两大新项目。其IPO本身就以666.07亿元的募资总额和368.10亿元的超募资金,成为观察国产存储产业资本热度的最新坐标。在AI大模型对内存容量和带宽需求近乎贪婪的当下,DRAM不仅是终端成本变化的推手,更是算力集群能否有效运转的底层约束。没有高密度、高带宽的国产存储,AI算力底座的地基就不算完整。
![]()
![]()
值得留意的是,这些动作发生在同一周并非完全巧合。外部出口管制持续收紧,把供应链不确定性变为常态;内部大模型竞赛进入参数规模与推理成本的双重冲刺期,国产算力从“备胎”转入“主力”的窗口被骤然打开。当算力需求侧的头部玩家与供给侧的技术储备在同一条时间轴上相遇,密集破局便成了必然。
算力之争,最终是体系之争
从Mate 90的终端芯片,到昇腾的中国份额反超,再到DeepSeek的软件生态搬运、壁仞的GPU追赶、长鑫的存储加码,组成了一幅相当完整的产业图景:中国AI算力底座的国产替代,已经不再是某一颗芯片的替代,而是从晶圆制造、芯片设计、互连协议、内存扩展、编译工具到开发者生态的全链路体系作战。
![]()
在这个体系里,“先进制程”仍然是一道客观存在的物理约束,但约束正在被其他维度突破:Peerium架构用互连把大量中端芯片拧成一台超大规模计算机;UnifiedBus用统一协议消除纵向与横向扩展之间的带宽鸿沟;TileLang用高级语言抽象技术绕开CUDA累积数十年的生态壁垒;长鑫用DRAM研发补上存储侧的供给缺口;而DeepSeek则用一套在昇腾上跑通、性能接近硬件上限的开源工具链,为“国产芯片不可用”的旧印象画上句号。
徐直军说,中国人不会接受由别人决定我们能否获得某种产品的未来。梁文锋说,这项工作“必须成功”。两句话在同一周交汇,指向同一个结论:算力自主的主动权,正从愿望变成工程,从工程变成生态。而生态一旦转起来,就不再是某一家公司或某一条赛道的事——它是整个中国ICT产业未来十年最坚实的底座。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.