网易首页 > 网易号 > 正文 申请入驻

摸着DeepSeek过河,OpenAI砍掉一半推理成本

0
分享至


▲本文图片均来自网络,如有侵权请联系删除

学习这件事,到处都有

本文 首发于影子备忘录

文 陌影笙

今年6月底,The Information扔出了一枚重磅炸弹:OpenAI的工程师们找到了一套系统优化方案,能把模型推理成本砍掉一半以上。

过去需要几万张GPU才能喂饱的算力需求,现在几百张就够了。

这个数字放在两年前,整个硅谷都会觉得是天方夜谭。但今天,它变成了现实,而且出自OpenAI自己之手。

更耐人寻味的是,这家曾经靠“大力出奇迹”横扫全球的AI霸主,正在走的这条路,DeepSeek早在一年多前就已经走过一遍了。

OpenAI在学DeepSeek。这是一个正在发生的事实。


OpenAI到底有多“缺钱”?

在聊OpenAI为什么学DeepSeek之前,得先搞清楚一个问题:OpenAI到底有多缺钱?

答案是非常缺。

2025年全年,OpenAI营收约130.7亿美元,相比2024年的37亿美元增长了253%。这个增速放在任何行业都是惊人的。但问题出在另一侧:总成本和支出高达340亿美元。

营收130亿,支出340亿。运营亏损209亿美元。

如果算上架构重组带来的一次性非现金计提,净亏损接近390亿美元。即便扣除那些不会重复的会计项目,调整后的亏损也有80亿美元左右。

进入2026年,情况并没有好转。第一季度营收57亿美元,同期现金消耗达37亿美元,已经烧掉了超过一半的收入。公司预计2026年全年亏损将飙升至250亿美元。

烧钱率高达83.3%。换句话说,OpenAI每赚1块钱,就要花掉将近2块钱。

更尴尬的是毛利率。2026年一季度,OpenAI的毛利率只有39%。虽然比去年同期的33%有所提升,但距离年末52%的目标仍有不小差距。

39%的毛利率放在SaaS行业里是什么水平?及格线都算不上。一家正经的软件公司,毛利率低于70%都不好意思跟投资人开口。

而OpenAI还在为能不能冲到52%发愁。

这背后的核心原因,就是推理成本太高了。

大模型这东西,训练烧一次钱,推理天天烧钱。

月活8亿的ChatGPT,每一次对话都在燃烧GPU。Sora这类视频生成工具更是算力黑洞,OpenAI已经不得不在2026年将其关停,把宝贵的算力资源转向更具商业确定性的方向。

与此同时,OpenAI正在推进一轮1200亿美元的融资,投前估值7300亿美元。公司还在秘密提交IPO申请,Sam Altman正全力争取在Anthropic之前完成上市。

在这个节骨眼上,盈利能力就是估值叙事的命根子。

推理成本砍一半,毛利率就能往上蹿一截。IPO的故事就能讲得更圆。这就是OpenAI突然对“省钱”这件事如此上心的根本原因。


DeepSeek早就走过的路

那DeepSeek是怎么做的?

2024年5月,DeepSeek在V2的技术报告中提出了一个机制,叫Multi-head Latent Attention(MLA)。

这个学术名词听起来很唬人,但核心目的就一个:压缩KV cache。

KV cache是什么?简单地说,就是大模型在生成文字时留下的“笔记”。

大模型生成回答是一个字一个字往外蹦的,每蹦一个字都要回头看前面已经说过什么。如果没有KV cache,每生成一个新字都要把整段话重新读一遍。

你问1万字的材料,生成第1个字读一遍,生成第2个字再读一遍,生成到第10000个字还要再读一遍。成本直接爆炸。

KV cache就是让模型记住“前面说过什么”,避免重复计算。

但这个“笔记”占的是显存,而且是高频读取的热数据。KV cache越大,需要的显存越多,GPU就越贵。

DeepSeek的MLA把KV cache压缩进了latent vector。效果惊人:相较于DeepSeek 67B,V2的KV cache减少了93.3%,最大生成吞吐提升到5.76倍。

到了V4系列,DeepSeek更是把性价比做到了极致。V4 Flash的输出价格仅为每百万token约0.84美元。而OpenAI GPT-5.5要30美元,顶配的pro版本要到180美元。

30美元对0.84美元。差了35倍。

DeepSeek凭什么敢定这个价?凭的就是从架构层面把推理成本打了下来。

更狠的是,2026年4到5月,DeepSeek把V4-Pro的API价格降至原定价的四分之一并永久执行。输入(缓存命中)价格低至每百万tokens 0.025元。

有创业者感叹:“这成本几乎比生产对应Token所需要的电费还便宜。”

与此同时,OpenAI还在用传统架构硬扛着高昂的推理成本。两者的成本曲线,已经不在一个维度上了。



OpenAI在学什么?

回到OpenAI这次的技术突破。

根据The Information的报道,OpenAI的优化方向主要来自KV cache上的优化。

具体来说,是Prompt Caching(提示词缓存)机制的升级。这个机制的本质就是KV cache的复用,模型第一次读完一段前缀后生成中间结果,后续请求如果用了相同前缀,就直接复用,不用重新计算整段prompt。

早在2024年10月,OpenAI就在开发者文档里加入了Prompt Caching。官方表示最高可以把延迟降低80%,输入token成本降低90%。

但这次不一样。这次是把整个推理成本砍掉了一半以上。

而且是用纯软件手段实现的,没换新芯片,没搞架构革命,就是把现有服务器的利用率给拧上去了。

这恰恰是DeepSeek最擅长的事。

DeepSeek从一开始就没打算跟OpenAI拼谁堆的GPU多。它的打法是:在有限的算力下,把效率榨干到极致。MLA压缩KV cache也好,MoE架构降低激活参数也好,核心逻辑就一个——用更少的算力做更多的事。

OpenAI这次做的,本质上是一样的事。

更有意思的是,开发这个新架构的团队,是一个从OpenAI剥离出去的独立团队。这意意味着OpenAI内部可能早就有人在探索这条路,只是直到今天才真正落地。

海外科技博主Andrew Curran表示,OpenAI在架构上出现了一个重大突破,尤其是在内存效率方面。

这个“重大突破”,DeepSeek在2024年就已经实现了。

OpenAI正在走的,是DeepSeek已经蹚过一遍的路。


从“炫技”到“算账”

OpenAI学DeepSeek,更深层的原因在于整个战略逻辑的切换。

过去几年,OpenAI的叙事是“大力出奇迹”,堆最多的GPU、训最大的模型、烧最多的钱,然后用性能碾压一切对手。

这个逻辑在GPT-4时代是成立的,因为那时候没有谁能跟OpenAI比烧钱。

但到了2026年,情况完全不同了。

一方面,模型性能的提升正在进入边际递减区间。GPT-4到GPT-5的提升幅度,远小于GPT-3到GPT-4。继续堆算力换性能的性价比越来越低。

另一方面,竞争对手不再是“能不能追上”的问题,而是“谁更便宜”的问题。DeepSeek用不到十分之一的成本提供了接近的性能。Anthropic在企业市场步步紧逼,谷歌虎视眈眈。

OpenAI再也不能躺在“最聪明”的牌桌上吃老本了。

于是我们看到了一系列战略转向:

2026年5月,OpenAI进行了IPO前夕最大规模的组织架构重组。ChatGPT、Codex、API三大产品线被全部打碎,合并为一个统一的产品组织。总裁Greg Brockman全面主导产品方向。

应用业务负责人Fidji Simo在全员会议上明确宣布:公司将降低Sora等消费产品的优先级,转而专注利润率更高的企业工具和编码产品。

企业业务收入已占OpenAI总收入的40%以上,预计到2026年底接近50%。

OpenAI还与博通合作开发定制推理芯片,试图进一步压低成本。

所有这些动作指向同一个方向:从“炫技”转向“算账”。

而“算账”这门功课,DeepSeek从一开始就在做。

当一个公司一年亏200多亿美元的时候,“省钱”就不再是一个选项,而是一个生存问题。

更何况OpenAI还要IPO。资本市场看的是盈利预期,不是技术有多炫。推理成本砍一半,毛利率从39%往52%冲,这个故事比“我们正在造AGI”值钱多了。

另一个原因是竞争压力。

DeepSeek V4系列发布后,已经有美国AI初创公司把部分工作负载从Anthropic迁移到了DeepSeek,省下了数百万美元的成本。

这不是什么遥远的威胁,而是事实。

OpenAI如果再不把成本打下来,失去的就不仅是市场份额,还有整个估值逻辑的根基。


OpenAI到底在学DeepSeek什么?

总结下来,OpenAI在学DeepSeek三件事:

第一,学成本意识。

DeepSeek从一开始就把“低成本”写进了基因里。训练R1只花了约560万美元,而GPT-4o的单次训练成本约1.2亿美元。推理成本更是只有OpenAI o1的3%。

这不是偶然,这是刻在骨子里的生存哲学。

OpenAI以前不需要省,因为投资人愿意为“最聪明”买单。但现在不行了。209亿的亏损,1200亿的融资,IPO在即,省下来的每一分钱都是利润。

第二,学架构创新。

DeepSeek的MLA把KV cache压缩了93.3%。OpenAI这次的优化方向同样是KV cache。

这不是巧合。这是技术路线上的趋同进化,当所有人都面对同样的算力瓶颈时,最优解往往是相似的。

第三,学商业逻辑。

DeepSeek的商业模式从来不是“卖最贵的模型”,而是“用最低的成本提供足够好的性能”。它通过API降价、峰谷定价、缓存命中优惠等手段,把Token做成了大宗商品。

OpenAI现在也在做同样的事。GPT-5.6 Sol的定价仅为竞品Claude Fable 5的一半。推理成本降低带来的定价空间,让OpenAI可以在保持毛利的同时发动价格战。

从“卖铲子”到“分金矿”,从“成本项”到“分成项”,这个转变,DeepSeek走在了前面。

OpenAI学DeepSeek这件事,本质上是一个迟到的觉醒。

过去几年,整个AI行业都被“规模法则”洗了脑,模型越大越好,算力越多越好,烧钱越狠越好。

这个逻辑在融资驱动的高速扩张期是成立的,因为投资人为增长买单,不为效率买单。

但当融资节奏放缓、IPO压力逼近、竞争从“谁更强”变成“谁更便宜”的时候,效率就成了唯一的答案。

DeepSeek从一开始就看透了这一点。它没有跟OpenAI拼谁有钱,而是拼谁更会省钱。事实证明,这条路不仅走得通,而且正在成为行业的主流方向。

OpenAI现在做的,不过是终于承认了这条路是对的。

从“大力出奇迹”到“省钱才是硬道理”,从“最聪明的模型”到“最划算的Token”,OpenAI的转向,标志着AI行业从“军备竞赛”进入了“精打细算”的新阶段。

而DeepSeek,早就在这个新阶段的起跑线上等着了。

摸着DeepSeek过河的OpenAI,到底能不能追上这个先跑了一年多的对手?答案可能要等2026年下半年的财报才能揭晓。

但有一点已经可以确定:AI行业的游戏规则,彻底变了。


特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
WTT澳门冠军赛:女单爆冷!张本美和3:0横扫,陈幸同压轴出战

WTT澳门冠军赛:女单爆冷!张本美和3:0横扫,陈幸同压轴出战

云上乌托邦
2026-09-11 15:26:58
规矩是死的,洋爹是活的。

规矩是死的,洋爹是活的。

美第奇效应
2026-09-11 23:26:00
学生不订奶被处罚,教室后面站成一排:蒙牛和他们有合作,武汉的所有中小学校都要订

学生不订奶被处罚,教室后面站成一排:蒙牛和他们有合作,武汉的所有中小学校都要订

江山挥笔
2026-09-11 08:19:59
“4岁男童被指摸臀”,男孩父亲最新发声:将进行反诉;不为索赔,只为给孩子要一个法律上的清白;胜诉赔偿全额捐给青少年公益

“4岁男童被指摸臀”,男孩父亲最新发声:将进行反诉;不为索赔,只为给孩子要一个法律上的清白;胜诉赔偿全额捐给青少年公益

都市快报橙柿互动
2026-09-11 14:03:52
9月10日晚上,根据中方公布的消息,应印度总理莫迪邀请,中方将于9月12日至13日赴印度新德里出席金砖峰会。

9月10日晚上,根据中方公布的消息,应印度总理莫迪邀请,中方将于9月12日至13日赴印度新德里出席金砖峰会。

回京历史梦
2026-09-11 17:35:27
18岁女子加前男友微信,被现男友发现,14秒私密语音暴露,两人争吵后女子跳楼坠亡,一审宣判

18岁女子加前男友微信,被现男友发现,14秒私密语音暴露,两人争吵后女子跳楼坠亡,一审宣判

扬子晚报
2026-09-11 19:43:05
59300元班费一学期花剩871元!深圳一初中家长曝光明细引争议,网友:千万不要让孩子去穷人多的学校

59300元班费一学期花剩871元!深圳一初中家长曝光明细引争议,网友:千万不要让孩子去穷人多的学校

火山詩话
2026-09-12 06:57:43
霍尔木兹海峡,有新消息!国际油价,跌了

霍尔木兹海峡,有新消息!国际油价,跌了

极目新闻
2026-09-12 08:50:28
8.8万奖金,大同一教师当场拆了:4.8万现场分给400多个学生,4万还给校长

8.8万奖金,大同一教师当场拆了:4.8万现场分给400多个学生,4万还给校长

听心堂
2026-09-11 10:06:10
“葫芦娃爷爷”重新挂上7个葫芦,并自制提示牌提醒游客注意安全,游客:爷爷说有人从一千公里外专程赶来,怕大家看不到葫芦会失望

“葫芦娃爷爷”重新挂上7个葫芦,并自制提示牌提醒游客注意安全,游客:爷爷说有人从一千公里外专程赶来,怕大家看不到葫芦会失望

扬子晚报
2026-09-11 21:18:08
尼泊尔泥石流灾害遇难人数升至1386人 失联5130人

尼泊尔泥石流灾害遇难人数升至1386人 失联5130人

新京报
2026-09-12 09:00:33
日月谭天丨“台独”分子与“太上皇”一唱一和,台湾恐被推向更险境

日月谭天丨“台独”分子与“太上皇”一唱一和,台湾恐被推向更险境

澎湃新闻
2026-09-11 22:26:05
亚洲4队冰火两重天!朝鲜提前晋级,中、日接近出线,韩国已命悬一线

亚洲4队冰火两重天!朝鲜提前晋级,中、日接近出线,韩国已命悬一线

绿茵舞着
2026-09-11 23:46:10
中年失业不可怕啊!三位40岁以上土木精英,一同考入中医药大学,评论瞬间炸锅:一毕业就是老中医

中年失业不可怕啊!三位40岁以上土木精英,一同考入中医药大学,评论瞬间炸锅:一毕业就是老中医

火山詩话
2026-09-11 13:07:26
今日赛事!9月12日CCTV5、CCTV5+节目表,男篮再冲一胜

今日赛事!9月12日CCTV5、CCTV5+节目表,男篮再冲一胜

江启
2026-09-12 09:09:15
“小婉君”金铭45岁现状:个子太矮事业受挫,住北京豪宅不婚不育

“小婉君”金铭45岁现状:个子太矮事业受挫,住北京豪宅不婚不育

兵卒史
2026-09-12 02:18:20
各说各话!周玉琴遭资遣、赖岳谦退出通告,中天公布两大关键理由

各说各话!周玉琴遭资遣、赖岳谦退出通告,中天公布两大关键理由

恋人视角
2026-09-11 14:52:23
后续来了!韦世豪官宣离开蓉城,现身新去处,为家乡球队送上支持

后续来了!韦世豪官宣离开蓉城,现身新去处,为家乡球队送上支持

倾世璃歌
2026-09-11 22:59:59
刘亦菲风波再升级!知情人曝内幕,早有先例,陈金飞或成最大底牌

刘亦菲风波再升级!知情人曝内幕,早有先例,陈金飞或成最大底牌

绚丽的画卷
2026-09-12 07:59:51
61岁蒋雯丽现状:曾定居英国,如今回国看病,衰老许多不敢认

61岁蒋雯丽现状:曾定居英国,如今回国看病,衰老许多不敢认

动物奇奇怪怪
2026-09-12 00:06:44
2026-09-12 11:28:49
影子聊科技 incentive-icons
影子聊科技
带你了解前沿科技资讯
70文章数 6关注度
往期回顾 全部

科技要闻

苹果折叠屏比小米华为贵5000元,该怎么选

头条要闻

iPhone Duo百万人预约被黄牛炒到9万元 网友:太疯狂

头条要闻

iPhone Duo百万人预约被黄牛炒到9万元 网友:太疯狂

体育要闻

老鹰真正的底气来自于什么?

娱乐要闻

港媒曝钟丽淇疑患渐冻症,本人发文

财经要闻

继房子茅台之后 中产的第"神话"也破灭了

汽车要闻

买菜车也有小乐趣 风云T7不止是台合格家用SUV

态度原创

房产
健康
手机
教育
艺术

房产要闻

别再等了!广州改善好房,正在进入“卖一套少一套”时代

手脚发麻口齿不清?也可能是中风!

手机要闻

三星向Tim Cook赠送Galaxy Z Fold 8 并幽默喊话“欢迎入场”

教育要闻

什么是留学家庭孩子体能训练陷阱

艺术要闻

18幅 萨夫拉索夫 风景油画

无障碍浏览 进入关怀版