网易首页 > 网易号 > 正文 申请入驻

首枚自研芯片发布背后,是Open AI的全栈野心?

0
分享至





作者|青苹吹果

编辑|无心插柳柳橙汁

Open AI的第一枚自研芯片造出来了。

前不久,Open AI在社交平台上晒出了一张图,画面里Sam Altman从博通CEO陈福阳手里接过了一片晶圆。



不是PPT,也不是概念图,是一颗已经在实验室里跑通了真实模型的工程样片。

它的名字叫Jalapeño,是Open AI从头设计的第一颗AI推理芯片,专治AI推理太贵、太慢、太耗电。

九个月前,它还只是一张白纸。而九个月后,它已经能在实验室里稳稳跑通GPT-5.3-Codex-Spark这样的模型,频率和功耗全部达标。

更离谱的是,帮它加速设计的,就是Open AI自己家的模型。

自己养的AI,帮自己造了副新“身体”?

不仅如此,这副新身体,还要用来跑更聪明的下一代AI,你用的ChatGPT、Codex,正在反过来帮它们自己打造下一代要跑的硬件。

我有种预感,这个飞轮一旦转起来,很多东西要被重写。



九个月

行业纪录被碾碎


经常造芯片的朋友们都知道,一颗高性能ASIC(专用集成电路),从定架构到交给工厂流片,常规周期是两到三年。

Google第一代TPU从架构到流片花了大约三年,传统芯片公司同等规模的项目动辄五到七年。

Open AI只用了九个月。

这速度,堪比芯片界的“特种兵极限越野”,被称之为“高性能先进半导体领域有史以来最快的ASIC开发周期”。这还真不是吹牛。

怎么做到的?两个原因,一个靠“脑力”,一个靠“体力”。

第一,AI帮自己画电路图,把验证的死循环跑成了“快进模式”。

芯片设计最折磨人的环节不是设计架构,而是设计完之后成千上万次验证、修改、再验证的死循环。这部分在项目周期里往往要占掉大半时间。

而AI恰好擅长干这种“暴力枚举”的脏活累活。

Open AI没有披露具体细节,但明确提到,他们用自家模型加速了设计和优化的部分流程。

这画面就有点科幻了,AI帮自己画电路图,电路图变成芯片,芯片跑出更强的AI,更强的AI再去画下一代芯片。

形成了一个自己给自己“递扳手”的闭环,速度能不快吗?

实验室里的工程样片已经在跑了,跑的是GPT‑5.3‑Codex‑Spark这类前沿模型,频率和功耗全部达到量产目标。

第二,挖来了专业团队,让最懂敲代码的人,反过来教芯片怎么跑代码。

Open AI硬件团队的掌门人Richard Ho,曾在谷歌做了九年TPU芯片工程,最高做到高级工程总监。



他那段时间参与发明的机器学习辅助芯片设计方法,让多个TPU项目第一次流片就成功了。之后他又去光子计算公司Lightmatter待过,几乎把“AI硬件”这条路上每个关键节点都踩了一遍。

2023年底他加入Open AI,迅速拉起了一支约40人的精锐部队。

一个懂LLM运行规律的人,带着一帮懂LLM运行规律的模型,去设计专门跑LLM的硬件,完全就是对症下药!

但有个问题:流片成功,就等于量产无忧吗?

当然不是。

流片只是把设计送去制造,距离大规模量产还有良率、供应链、软件生态一堆坎要迈。

但九个月能把一张白纸变成一块能跑的硅片,这个节奏本身已经够让人咂舌了。



为什么不碰“训练”

专攻“推理”?


Jalapeño有个很明确的定位:只做推理,不搞训练。

训练和推理,对芯片的要求完全是两码事。

训练,是教模型“读书认字”的阶段。你得把全网的公开资料、书籍、代码一股脑塞给它,让它从海量数据里自己摸索出规律。

这个过程需要极其恐怖的算力密度,以及海量的高带宽内存来喂数据,而且对通用计算能力要求极高。

在这个领域,英伟达的GPU凭借CUDA生态和硬件架构,筑起了一道几乎无法逾越的护城河,短期内谁也撬不动。

推理就不一样了,推理是模型“答题”的阶段。

你打开ChatGPT敲下一行字,点击发送,服务器那头在几秒钟之内生成回答并传回给你,这就是推理。

推理任务的特点是:模型已经定型了,不需要再学新东西,只需要在既定框架下快速、低成本地处理海量用户请求。

这种工作,最适合用专用芯片来做精准优化,把每一瓦电、每一分钱都榨出最大价值。

Open AI选择从推理侧下场造芯,是一个相当务实的决策。

为什么这么说?因为很多人没意识到,推理正在悄悄取代训练,成为算力消耗的头号大户。

行业里的主流模型,推理端消耗的算力已经逐渐超过了训练端。



训练模型像盖一栋大楼,图纸画完、主体封顶,钱一次性花出去了,后面就不用再掏了。但推理呢?大楼盖好之后,每天开门营业,空调、电梯、照明、维护,每一秒都在往外掏钱,只要还有用户在问ChatGPT,这钱就停不下来。

换句话说讲,训练是“首付”,推理是“月供”,月供可是要还一辈子的。

对于ChatGPT这种用户量以亿为单位的产品来说,推理成本如果一直居高不下,盈利就永远是一笔算不过来的账。

用户越多,回答问题越勤快,算力账单就越滚越大,收入还没捂热就被成本吃掉了。

Jalapeño就是冲着这个死穴来的。

博通CEO陈福阳透露,跟市面上主流的AI图形处理单元相比,Jalapeño能把推理成本砍掉接近一半。

原来处理一次请求花两毛,现在一毛出头就够了。省下来的全是利润空间。

不止成本,性能方面的消息也很炸。

早期测试显示,Jalapeño的每瓦性能“大幅优于当前业界最先进水平”。陈福阳在接受路透社采访时甚至放话说,这颗芯片的表现足以和英伟达Blackwell、Google TPU掰手腕。



不过,目前这些数字都是官方自己说的,还没有第三方独立实验室跑过基准测试。

官方喊“媲美Blackwell”,具体是在什么模型上测的、什么并发条件下跑的、跟Blackwell的哪个配置比的,这些细节都得等技术报告正式发布才能见分晓。

但这不妨碍我们先兴奋一下。



Open AI的“全栈”野心

不只是造颗芯片


Jalapeño意为墨西哥辣椒,属于辣度最温和的品种。

起这个名字,其实也是Open AI在暗示:Jalapeño只是第一步,以后面还有更“辣”的。



以前Open AI的活法很简单:只管专心搞模型,至于算力和数据中心,全丢给微软和英伟达去头疼。

这让他们在早期的模型军备竞赛里跑得飞快,但也埋下一个结构性隐患——算力成本的定价权,不攥在自己手里。

命门在别人手上,交租得看房东脸色。

而Open AI今天面对的竞争环境,已经和两三年前完全不同了。

在过去,模型能力是最大的竞争变量,只要能把模型做得更聪明,算力贵一点还能忍。但进入Agent、AI编程、AI视频等新阶段后,模型能力正在逐渐趋同,真正拉开差距的,开始变成谁能以更低的成本、更大的规模,把智能战力持续送到用户手里。

换句话说,AI竞争正在从“谁模型最好”转向“谁交付智能的效率最高”。而推理芯片,恰恰就是决定这种效率的底层基础设施。

2025年秋天之后,Open AI的动作明显变了节奏。



先是和博通宣布合作搞自研加速器,紧接着跟英伟达签了千亿美元级别的数据中心协议,又和AMD锁定了6GW的芯片供应,2026年6月还跟Cerebras谈下了750MW的推理算力订单。

加上这次Jalapeño芯片正式亮相,四条路线齐头并进:

自研芯片、英伟达、AMD、Cerebras。

现在看,你还会觉得Open AI是一家单纯“做模型的公司”吗?

显然不会了。

从更长远来看,自研芯片的意义,甚至不只是节省成本。

AI行业正在进入一个新的竞争阶段:模型、芯片、网络、数据中心、软件栈开始越来越紧密地耦合在一起。未来真正领先的AI公司,比拼的可能不再只是某一个模型,而是整套基础设施是否能够协同优化。

就像苹果通过自研M系列芯片,把硬件、操作系统和应用生态整合成一个整体一样,Open AI也正在尝试把模型、推理系统和底层硬件一起设计。这意味着,它希望优化的不只是某一个模型,而是整个AI服务链路。

而且Open AI的IPO筹备正在路上。在这个节点上推出自研芯片,就是在非常明确的向投资市场传递信号:这家公司有办法、有计划把推理成本这个最大的出血点给堵上。

财务叙事和技术叙事在此汇合。

合作模式上,Open AI选了一条务实路线。

芯片架构、内核优化、服务系统由自己主导;硅实现和网络互联交给博通(谷歌TPU就是通过博通量产的,这条路已经跑通过);板卡、机架和系统集成则交给了加拿大的Celestica,顺带一提,这家公司同样是谷歌TPU的首选制造伙伴。

三家拼起了一张完整的拼图。

博通CEO陈福阳把这次合作称为“一项根本性承诺”,不是一次性项目,而是一个多代际路线图的起点。

Jalapeño只是开始,根据此前媒体报道,第二代芯片的代号叫“Serrano”,同样是一种辣椒。

部署时间线也定了,2026年底开始初步部署,之后逐年扩展,最终目标是和微软等合作伙伴一起,建设吉瓦(GW)级别的数据中心。

吉瓦是什么概念?

大约相当于整个北京市的居民用电量。这种量级的电力调度,本身就是一种基础设施建设能力的终极压力测试。

Open AI正在从一家AI实验室,蜕变成一家全栈AI公司。

模型自己训,芯片自己设计,推理自己优化,部署自己控制。



你的ChatGPT账单

正在被重写


说了这么多,这些跟我们普通人有什么关系?

关系大了,以后我们用的AI将会越来越“物美价廉”。

Greg Brockman在发布时说过:“世界正在转向一个由算力驱动的经济。”



这话听着大,但细想不虚。

无论是学生想借助AI理解一篇论文,还是小企业用API搭建一个客服系统,又或者独立开发者靠代码助手完成一个项目,背后都是算力在悄悄做功。

而算力成本的高低,直接决定了这些东西是少数人的工具,还是多数人的日常。

Open AI把Jalapeño定位在推理侧,本质上是在做一件事:让智能变得更便宜、更快、更稳定。

每次推理延迟少一秒,每个API调用价格降一分,落到每一个普通人那里,就是能用更少的钱,更顺畅地使用AI,甚至用上那些今天还只属于大企业和付费用户的高级能力。

打个比方,你以前每月花钱订阅,请回来的就是个能陪你侃大山的“高级AI陪聊”。但到了明年,同样的价钱,你请回来的可能是个能帮你把整份PPT做完、顺便把Excel表也清理了的“全能实习生”。

价格没变,但“打工人”的段位飙升了好几级,加量不加价。

当然,不只是花钱的用户。当算力变得跟水电一样便宜,曾经只有大厂才烧得起“最强大脑”,以后可能就变成每个人随手就能用的标配工具。




回过头来看整件事,最妙的其实是这个循环:

AI设计芯片 → 芯片跑AI → 更强的AI设计下一代芯片。

更好的基础设施→更高的算力效率→更好的训练和服务→更强的模型→更好的产品→更多用户和收入→再投入下一代基础设施。

这个飞轮一旦转起来,就是自我加速的。

Google有TPU,Amazon有Trainium,Meta有MTIA,微软有Maia。OpenAI现在也有Jalapeño了。

大模型公司造芯片,正在从“要不要”变成“能不能”的问题。

当然,从流片到大规模量产,中间还有良率、供应链、软件生态等一系列问题要解决。

要知道,英伟达那个CUDA平台,就像是AI界的“通用语言”或“水电网络”,大家用了十几年,早就习惯成自然了。现在你想让所有人换套新系统?那难度不亚于让全国司机一夜之间改靠左行驶。

再看看前面的老大哥:谷歌的TPU打磨了十年才有今天,亚马逊的Inferentia也是踩了无数个坑、迭代了好几轮才敢大规模铺开。

Open AI想凭一颗“辣椒”就一步登天?路还长着呢。

但Jalapeño的出世至少证明了一件事:AI不仅能帮人干活,还能帮自己造“身体” 。

用最懂LLM的模型,设计最跑LLM的硬件,一旦这个循环跑起来,那个“算力更便宜、AI更普及”的未来,将会加速到来。





特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
新政出台:买公寓的打工人,遇上被背刺最狠的一次!

新政出台:买公寓的打工人,遇上被背刺最狠的一次!

城事堂
2026-09-10 09:50:30
别让刘翔带着“问号”离开

别让刘翔带着“问号”离开

齐鲁壹点
2026-09-10 18:09:09
这么多“刚好”、“巧合”凑在一起,你觉得公众会信吗?

这么多“刚好”、“巧合”凑在一起,你觉得公众会信吗?

走读新生
2026-09-10 17:24:39
刘翔发文后上海体育局通报:11年平均月薪7174元,几十万买断,体育人争光成了一张遮羞布

刘翔发文后上海体育局通报:11年平均月薪7174元,几十万买断,体育人争光成了一张遮羞布

李晚书
2026-09-10 15:36:04
一露毁所有?刘嘉玲宝格丽晚宴翻车,恰恰印证了亦舒那句经典名言

一露毁所有?刘嘉玲宝格丽晚宴翻车,恰恰印证了亦舒那句经典名言

谢葅解说
2026-09-09 17:31:51
越南女星回应合照被刘亦菲裁掉了:我会更加努力

越南女星回应合照被刘亦菲裁掉了:我会更加努力

韩小娱
2026-09-10 08:32:00
男子教师节给40多位老师发祝福短信后被停机,运营商:证明号码是本人使用可恢复

男子教师节给40多位老师发祝福短信后被停机,运营商:证明号码是本人使用可恢复

澎湃新闻
2026-09-10 17:46:08
“打我妈不行”,排队冲突中老人多处骨折,不予刑事立案

“打我妈不行”,排队冲突中老人多处骨折,不予刑事立案

中国新闻周刊
2026-09-10 20:35:09
刘翔,教科书式公关

刘翔,教科书式公关

贩财局
2026-09-10 13:41:33
碰瓷4岁幼童的小仙女陈锦婷真容曝光!普通路人一个,和美颜照片差距感拉满

碰瓷4岁幼童的小仙女陈锦婷真容曝光!普通路人一个,和美颜照片差距感拉满

小徐讲八卦
2026-09-10 06:24:52
金砖峰会还没开幕,印度提前放出风声,将对中国提出4个要求?

金砖峰会还没开幕,印度提前放出风声,将对中国提出4个要求?

史料布籍
2026-09-10 14:30:27
山东青岛一外籍货轮靠港维修期间起火,什么是“靠港维修”?维修期间有哪些问题必须注意?

山东青岛一外籍货轮靠港维修期间起火,什么是“靠港维修”?维修期间有哪些问题必须注意?

贵重物品爱美食
2026-09-10 19:14:47
坚决支持中国政府的严正声明,越南占领的中国岛礁全部归还

坚决支持中国政府的严正声明,越南占领的中国岛礁全部归还

叶老四
2026-09-09 13:55:36
火力全开,几度哽咽,扎哈罗娃五分钟怒斥日本:“你们不应该跪下来道歉吗”,屠杀中国、苏联平民时,戴的不正是菊花纹章吗

火力全开,几度哽咽,扎哈罗娃五分钟怒斥日本:“你们不应该跪下来道歉吗”,屠杀中国、苏联平民时,戴的不正是菊花纹章吗

第一财经资讯
2026-09-10 14:22:34
柳叶刀:中国人精神压力极大 全国精神障碍患病人数已达1.9亿

柳叶刀:中国人精神压力极大 全国精神障碍患病人数已达1.9亿

可达鸭面面观
2026-09-10 13:18:53
伊朗下令暂停对进出伊朗、运输能源产品的外国船舶收取10%的运费附加费

伊朗下令暂停对进出伊朗、运输能源产品的外国船舶收取10%的运费附加费

财联社
2026-09-10 19:17:16
扎哈罗娃反问日本:当年屠杀中国、苏联平民时,戴的不正是菊花纹章吗?此前高市早苗要求俄拆除战胜军国主义日本的纪念碑

扎哈罗娃反问日本:当年屠杀中国、苏联平民时,戴的不正是菊花纹章吗?此前高市早苗要求俄拆除战胜军国主义日本的纪念碑

鲁中晨报
2026-09-10 13:43:05
捕获!伊朗发了一条消息

捕获!伊朗发了一条消息

环球时报国际
2026-09-10 17:05:25
纱窗效应明显!iPhone Duo屏下前摄被吐槽 网友:还不如5年前的小米MIX 4

纱窗效应明显!iPhone Duo屏下前摄被吐槽 网友:还不如5年前的小米MIX 4

快科技
2026-09-10 15:43:16
人民日报发声!已经不是简单道歉的事,多名律师支持男童一方起诉

人民日报发声!已经不是简单道歉的事,多名律师支持男童一方起诉

放开他让wo来
2026-09-10 10:43:36
2026-09-11 03:24:49
超前实验室 incentive-icons
超前实验室
前沿科技,超前观察? ——『超前实验室』
34文章数 4关注度
往期回顾 全部

科技要闻

一文看懂:iPhone折叠屏顶配2万6,10月才卖

头条要闻

特朗普:如果伊朗拥核 我会对最高领袖说"能为您效劳吗"

头条要闻

特朗普:如果伊朗拥核 我会对最高领袖说"能为您效劳吗"

体育要闻

16岁的国产小库里,还有多少功课要做

娱乐要闻

参加晚宴,刘亦菲因合照深陷争议

财经要闻

向松祚:年轻人不必过早买房

汽车要闻

标配全线控底盘 全新一代智己LS6预售20.99万起

态度原创

游戏
家居
旅游
时尚
艺术

LPL二路主播再惹争议,祸从口出遭iG粉丝举报,口嗨假赛发文道歉!

家居要闻

2026建博会(广州) 公装联探展交流活动

旅游要闻

大理旅游便民卡“橙意”上线,全年不限次出游!

“蛇精”围攻,葫芦爷爷求饶

艺术要闻

别再问中国意境是什么了!看完中国古建筑,才知道什么叫惊世之美!

无障碍浏览 进入关怀版