21世纪经济报道记者孙燕 无锡报道
今年以来,随着人工智能大模型的爆发式增长,存力正加速崛起,成为与算力并驾齐驱的核心。
8月31日,2026集成电路(无锡)创新发展大会在无锡开幕。海威智算(江苏)科技有限公司董事长苏欣在接受21世纪经济报道记者采访时表示,算力的比拼已经不是过去简单地拼FLOPS,而是在拼应用落地场景和交付落地能力。
“可能在一两年前,我们经常还能看到用多少P、E的FLOPS来讨论智算中心。但是过去近一年的时间里,我们已经不这么算了。因为算和存已经紧密结合在一起,智算中心的评估不再只是算力的堆叠,而是存储方面的整体应用。”苏欣指出。
21世纪:香农芯创2024年在无锡设立海普芯创深耕企业级存储,2026年又在无锡设立海威智算进军AI智算领域。连续将两家核心企业落地无锡,您对无锡的半导体和AI产业环境有何评价?
苏欣:在集成电路行业,配套相当重要。这既包括上游供应商、设备的配套,也包括测试、工厂及能力的配套,当然还有人员、团队、技术等方面的配套。
在这一点上,我们发现无锡是一块非常好的创业宝地。以无锡为中心,方圆200公里以内,我们几乎能够找到所需的全部配套资源。例如,该区域内聚集了全球最大的封装测试生态圈。
谈到AI和大模型,在这里我们也能够找到更多的AI落地场景。实际上,无锡本身就是AI应用落地的重要节点——无锡拥有8万家工业企业(其中规上工业企业超过8000家)、5个国家级先进制造业集群,工业视觉检测、工业大模型、智能制造等场景对推理算力有海量且迫切的需求——这正好对应海威智算R9600的“行业视觉智能、工业检测”等核心应用场景。
工业和AI的深度融合与应用,我认为正是AI风口的下一步。下一步要找到落地的应用,让AI真正赋能每一个生产型企业,使它们更有效率。
制造业AI化转型构成最大的应用市场牵引。在无锡,我们能看到封装测试、先进设备制造、智能驾驶等方方面面的工业应用场景。这些场景为我们的新技术、新产品提供了足够的用武之地,让它们能够真正找到落地的土壤。
21世纪:从存力到算力,香农芯创有着越来越清晰的布局,作为公司算力业务的排头兵,海威智算准备如何抓住算力的机会?
苏欣:“算”与“存”在过去一年里,是整个科技市场最热的话题。
我们看到,算力需求正在以每6个月翻一番的速度增长。模型也越来越大,去年年初DeepSeek还是671B规模,也就是6710亿参数的模型;但到了今年7月,模型的参数规模已经突破了2万亿——算力需求的翻倍增长,实际上带来了比翻倍更大的存力需求。
我们也观察到,英伟达和AMD在最近一段时间的产业结构调整中,已经把投资重心更偏向于对内存的使用。在KV Cache、显存、带宽这些方面,我们会发现,算力的比拼已经不是过去简单地拼FLOPS,而是在拼存储需求。
具体到实践层面,海威智算运用AMD Radeon芯片组,搭建国产化的推理GPU模组。去年年底,我们在无锡搭建了AMD全球首个ROCm推理智算中心,规模达5000卡,就部署在中国移动无锡马山机房。在这个算力中心里,便用到了香农芯创的企业级存储产品。所以,这是一个非常好的协同案例——它充分证明了无锡的整个产业配套能力:不管是从上游的供应链,还是到下游的客户应用,我们都能够看到很多类似的落地实践。
21世纪:在面对国际大厂和国内同行竞争时,海威智算的核心差异化优势是什么?
苏欣:从算力的生态格局来看,开源是破局的关键。目前市场上,有超过80%的计算路径,仍然相当依赖英伟达和CUDA的组合。而CUDA是闭源的,如何能够打造一个更开源的环境?ROCm就是一个非常好的切入点。
我们看今天的市场,其实非常像2012年到2015年iOS和安卓之争的阶段。当时智能手机是苹果iOS的天下,是闭源的,开源的安卓还有很长的路要走——不管是高通还是联发科,他们都要解决智能手机如何在安卓系统上运行的问题。但如今,这两个生态已在共同发展,甚至安卓的市场份额已经大大超过了iOS。
这也证明了,开源能够吸引更多的用户加入大本营。ROCm作为全球智算领域最大的开源生态,依托AMD的整体算力基础,有较好的市场前景。相信ROCm生态的不断壮大,能够为国内多提供一个开源生态的选择:它更安全、更开放,在生态对接的过程中也会吸引更多人才加入这个生态。
无锡是全国AMD ROCm生态智算中心的发源地。2025年12月,全球首个基于AMD Radeon的开源生态智算中心(新威智算中心)在无锡高新区国家软件园点亮,一期部署5000张AMD Radeon PRO W7900D GPU,2026年7月还支撑了AMD Advancing AI全球开发者大会的千卡跨国算力输出,全程零故障。
21世纪:业界越来越意识到,存储优化已成为打破AI性能瓶颈的关键方向之一,业内出现了以存换算、存算一体等路线,您如何看待这一趋势?
苏欣:“算”和“存”的深度融合一定是一个大趋势。
随着算力规模越来越大,大家现在已经不再简单地用算力堆叠来衡量智算中心了。可能在一两年前,我们经常还能看到,用多少P、E的FLOPS来讨论智算中心。但是过去近一年的时间里,我们已经不这么算了。因为算和存已经紧密结合在一起,智算中心的评估不再只是算力的堆叠,而是存储方面的整体应用。
如何让存储变得更有效?如何让算力跑得更便宜?这些才是大家真正需要讨论的议题。
海威智算的定位是以“硬件工程 × ROCm软件 × 生态协同”驱动推理算力落地,我们致力于打造深耕AMD ROCm开源生态的GPU推理算力产品公司,使命是连接开源生态,让普惠推理算力赋能千行百业。
这种“借开源生态+做交付封装”的打法,本质上是把生态建设的重活交给全球开源社区,把差异化做在“让企业真的用起来”这一段——而这恰恰是ROCm在中国市场最稀缺的工程化能力。全国首个ROCm开源生态智算中心在无锡落地的实践,已验证这条路线的可行性。
“芯生万象 链动无界”系列对话
采写 孙燕
统筹 卜羽勤
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.