关注AI基础设施这么久,这一天还是来了。
7月10日,中科曙光宣布,中国首个全国产十万卡AI超集群——曙光8000正式落成,并通过国家超算互联网接入全国一体化算力网络。
![]()
至此,十万卡终于从规划走向现实落地。
十万卡落地,到底难在哪儿
“卡”指的是AI计算卡,也就是支撑人工智能训练和推理的核心计算单元。
随着大模型快速发展,AI训练规模不断扩大,从几百张计算卡,到千卡集群,再到万卡集群,计算规模一次次突破。
很多人可能觉得,十万卡无非就是“卡更多了”。但真相是:十万卡远不是简单堆叠。
十万卡,意味着将海量计算单元连接成一个统一、高效协同的“超级计算机”,同时服务于大模型训练、科学计算和产业智能化应用。
![]()
在这个“机器”中,几十万级计算单元如何高效协同?海量数据如何高速流动?训练任务如何长期稳定运行?不同类型任务如何灵活调度?能源消耗如何控制?
任何一个问题解决不好,都可能让十万卡变成纸上谈兵。
所以,十万卡级AI超集群真正比拼的,不只是峰值性能,更是整个系统的工程能力。
曙光8000,到底强在哪儿
曙光这次打造的,是一套面向下一代AI计算需求重新设计的超智融合基础设施。
在曙光8000背后,是一套由“芯片、计算、存储、网络、散热、应用、服务”等核心技术组合而成的全链路AI基础设施能力。
从底层芯片到计算系统、从高速网络到高性能存储、从液冷散热到生态应用软件……每一个环节,都决定着十万卡系统能不能真正跑起来。
![]()
高性能网络,是十万卡集群最关键的“神经系统”。
过去,超大规模AI集群高速互联长期依赖国外技术体系。
曙光8000搭载自研scaleFabric类IB原生RDMA高速网络,让十万卡之间实现低时延、高带宽、高可靠连接。
存储,则决定了大模型和科学计算的数据供给能力。
曙光8000采用ParaStor分布式存储系统支撑海量数据读写。
此前,ParaStor F9000全闪存储已经在国际权威IO500榜单中获得生产型全节点和10节点性能全球第一,验证了国产高性能存储在极限负载环境下的能力。
曙光8000实现的不只是“建成”,更重要的是“稳定运行”。
十万卡,到底能干什么
当十万卡真正跑起来,算力革命就开始了。
曙光8000通过国家超算互联网接入全国一体化算力网络后,将面向科研机构和产业用户提供高水平算力服务。
目前,在十万卡核心节点上,已经完成300余项重点超智融合应用优化,覆盖材料、流体、量子、生物医药、天文气象等20余个前沿科研领域。
并累计完成70余次万卡规模算力测试,验证了超大规模集群在高负荷科研任务中的稳定性。
更重要的是,曙光8000落地即走向了“持续建设”。
光合组织2026智能计算应用大会期间,中科曙光还与北京科学智能研究院达成战略合作,启动第二套全国产十万卡超智融合算力系统研制与建设。
这意味着,十万卡成为可复制、可持续演进的新型智能计算基础设施能力,而非一次性的“放卫星”工程。
一大批应用成果已经展现十万卡级算力的价值↓
加速蛋白质折叠全流程模拟,赋能生命科学、新药研发;
完成3.16万亿原子DTF精度分子动力学模拟,刷新全球同类科研纪录;
完成328万亿网格湍流直接模拟,支撑航空、船舶、工业流体研发。
这些案例说明,十万卡正在成为推动科学发现和产业创新的新型基础设施。
从国产芯片,到高速网络;
从高性能存储,到超大规模集群;
从补短板,到建体系;
从跟随建设,到自主定义下一代AI基础设施…
这一次,十万卡AI超集群的落地,不只是集群规模的一次跃升,它更像吹响了冲锋号角,中国智能计算基础设施,正在加速迈入一个全新时代。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.