![]()
据美国消费者新闻与商业频道(CNBC)8月24日报道,全球芯片巨头英伟达(Nvidia)于周一正式宣布,其Groq 3 LPX机架已进入全面生产阶段。
这标志着英伟达历史上规模最大的一笔收购案——斥资200亿美元收购芯片初创公司Groq资产后,相关核心技术正式开启大规模商业化进程。
英伟达高级总监迪翁·哈里斯在记者会上披露,这款备受瞩目的Groq机架将与英伟达旗下的Vera中央处理器、Rubin图形处理器一同部署在新型云服务商Nebius中,并计划于今年晚些时候正式上线。
事实上,英伟达如此急于将Groq芯片推向市场,背后有着深层的战略考量。随着AI智能体(AI Agents)的爆发,用户对响应速度的要求近乎苛刻,尤其是在编程代码生成领域,任何微小的延迟都会严重影响体验。说白了,英伟达这次砸下重金,就是为了解决AI“反应慢”的痛点,让AI像真人一样对答如流。
“对于提供代币(Token)服务的厂商来说,这开启了提供高端服务的能力,”哈里斯在电话会议中直言,“能够满足那些对延迟最敏感的客户的严苛需求。”
这笔高达200亿美元的收购案发生在去年12月,是英伟达成立以来最昂贵的一次“买买买”。
与传统的GPU架构不同,Groq架构在芯片内部集成了高达500MB的高速SRAM,直接从物理层面消除了内存瓶颈。值得注意的是,虽然英伟达的GPU由台积电代工,但Groq芯片则交由三星制造,展现了英伟达在供应链上的多元化布局。
在性能表现上,英伟达的数据堪称惊人。根据Artificial Analysis的基准测试,英伟达将256颗Groq 3芯片封装进单个LPX机架后,每秒可处理3400个代币。
![]()
这是一个什么概念?相比之下,竞争对手AMD此前宣布将集成Cerebras的芯片组,而OpenAI最新推出的“超快模式”目前每秒仅能处理750个代币。英伟达的这一数据,几乎是对手的4.5倍,直接在低延迟推理领域拉开了代差。
业内分析人士指出,低延迟芯片并不会取代GPU这一AI算力的“劳模”,因为GPU在模型训练和推理灵活性上依然无可替代。Groq芯片更像是一个“专才”,主要负责模型服务中被称为“解码”的关键阶段。
英伟达CEO黄仁勋对这套组合拳寄予厚望。在今年3月的发布会上,他曾大胆预测,从当前的Blackwell芯片到全新的Vera Rubin系统,到2027年累计销售额将达到惊人的1万亿美元。
为了展现对Groq技术的信心,黄仁勋当时明确表示,他将把数据中心内用于编程应用空间的四分之一全部分配给Groq芯片。
英伟达预计将于本周三发布最新财报,全球投资者正密切关注这一算力帝国的扩张版图。谈及GPU与Groq芯片的协作关系时,黄仁勋曾斩钉截铁地表示:“我数据中心剩下的部分,将全部是100%的Vera Rubin。”
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.