网易首页 > 网易号 > 正文 申请入驻

最多80%!GPT5.6系列官宣降价,被中国厂商逼的?

0
分享至


出品 | 网易智能

作者 | 辰辰

编辑 | 王凤枝

上线仅三周,价格最高下调八成。

OpenAI的GPT-5.6系列7月上旬才推出,7月30日,Luna模型就从每百万token输入1美元,直接砸到20美分。中档的Terra降20%。旗舰Sol纹丝不动。

CEO山姆·奥特曼(Sam Altman)在X上发帖:"今天宣布大幅降价。"


官方解释是:GPU内核、推理系统和生产环境效率均有所提升,公司将效率提升带来的收益部分反馈给用户。

听着很合理。但Luna降80%,Terra降20%,Sol一分不降。这个降价格局,单靠"效率提升"四个字解释不了。


烧钱时代结束了

硅谷有一个词,叫tokenmaxxing。

意思是在使用AI时尽可能增加token消耗,以最大化使用AI能力,而不优先考虑成本。这个词诞生于2023年,本身就带着自嘲。彼时ChatGPT引爆全球,美国企业争先恐后把AI塞进每一个工作流,账单的事以后再说。

现在,账单来了。

AI账单已经膨胀到数十亿美元规模。CNBC的报道里有一个细节:亚马逊刚刚把2026年的资本支出上调到2200亿美元,其中一大块烧给了AI基础设施。企业端的AI开支同样在膨胀。软件公司、金融机构、医疗集团,每家每年花在AI API和智能体上的钱,动辄数千万美元。

《华尔街日报》6月份就披露过,OpenAI在考虑大幅降价,而它预判竞争对手Anthropic也会跟进。企业高管开始不耐烦了。 Uber一位高管透露,公司2026年的AI智能体预算已经用尽。另一位科技公司负责人坦言:很难把AI编程带来的效率提升,直接对应到新功能和新收入上。


"tokenmaxxing的时代结束了。" 市场研究机构EMARKETER高级分析师雅各布·博恩(Jacob Bourne)这样公开下了判断。

企业不再照单全收。他们在问同一个问题:花了几千万美元,到底换来了什么?

CNBC有篇最新报道的标题耐人寻味:China's open-weight model lead exposes America's AI blind spot。中国开源权重模型的领先,暴露了美国AI的盲区。这个盲区不是技术,是成本。


过去,这个问题最多让AI公司有点尴尬。现在不一样了。中国公司带着另一种打法登场了。


中国模型的另一种打法:

开放权重

7月初,中国初创公司月之暗面(Moonshot AI)发布了开源权重模型Kimi K3。在一些行业基准测试中,它的表现超过了美国最先进的闭源系统。


关键是:Kimi K3的模型权重是公开的。 用户可以下载、修改,并部署在自己的基础设施上,不需要支付月之暗面的API调用费用。

它不是孤例。DeepSeek、智谱(Z.ai)的GLM-5.2、阿里的Qwen系列。一些中国公司正在通过开放权重、低价服务等方式提供前沿AI能力。

《The Verge》在一篇深度分析中直指核心矛盾:"一家AI公司花了天量资金训练模型,为什么要把最有价值的部分免费送出去?"

福特汉姆大学法学教授钦玛伊·沙玛(Chinmayi Sharma)的答案很透彻:"一组免费的权重,不等于一个免费的AI服务。公司可以在模型免费的同时,从计算基础设施、工程、安全、维护等环节赚钱。"

当中国开源权重模型的性能追平闭源,开发者开始在AWS、Azure甚至本地集群上私有化部署这些模型,直接切走了OpenAI的API调用量。 对OpenAI来说,丢掉的不只是一笔笔推理收入,更是"默认选项"的地位。一旦开发者习惯了开源部署的工作流,就很难再拉回来。

乔治城大学安全与新兴技术中心高级研究员凯尔·米勒(Kyle Miller)以阿里Qwen系列模型为例,指出它在中国产业界的渗透深度,展现了开源生态一旦扎根的威力。

美国这边,围绕开源权重的政策辩论也起来了。Kimi K3发布后,一个由25家科技公司组成的联盟(包括IBM、微软、Meta、英伟达、Palantir)发表公开信,警告美国政府不要对开源权重模型施加"过早的限制"。这封信点名缺席的,恰恰是OpenAI、谷歌和Anthropic三家闭源巨头。

《The Verge》的报道标题写得直白:Why China is giving away its best AI models。中国为什么要把最好的AI模型免费送人?

对美国闭源模型提供商来说,这不仅是价格竞争,也涉及商业模式的挑战。当中国公司把前沿模型免费开放,OpenAI和Anthropic还能靠"按token计价"的模式撑多久?


但涨价也在发生

中国开源权重模型用免费撕开了一道口子。但免费是一种打法,不是所有中国公司都选了这条路。

就在OpenAI宣布降价的同一天(7月30日),中国AI公司智谱在国内不限量重新开放了GLM Coding Plan订阅服务,价格不是降了,是涨了。或者更准确地说,是跟国际版价格对齐。


Lite档从每月49元涨到118元,涨幅140%;Pro档从149元涨到538元,涨幅260%;Max档从469元涨到1078元,涨幅130%。

智谱今年已经涨过好几次。2月,GLM Coding Plan整体上调30%起步,取消首购优惠。3月,GLM-5-Turbo API加价20%。4月,海外版全线涨价80%到140%。一季度累计下来,智谱的API定价提升了83%。

价格上涨,但用量增长更快。400%。

这是整个故事里最反直觉的一组数字:价格涨了八成,用量翻了四倍。智谱CEO张鹏在业绩说明会上的解释是:模型能力提升意味着推理链路更长,一个复杂任务的token消耗量可以达到简单问答的十倍甚至百倍。涨价"是成本变化的自然结果"。

智谱的官方表态更直白:低价竞争不利于行业发展,价格需要"回归正常商业价值区间"。摩根大通7月研报给出了投资端的注脚:GLM-5.2的平均API收费较上一代提高了约13%,公司"展现出更强的定价能力"。目标价上调到1800港元,维持增持评级。

这不只是智谱一家的事。据律动BlockBeats统计,2026年初以来,中国已有七家云厂商和模型厂商上调价格,最高涨幅超过400%。中国AI行业正在经历一个集体转身:从"免费补贴抢用户"转向"商业变现求生存"。

同一个中国市场,正在上演两出完全相反的戏。

需要分清两件事的计价对象。Kimi K3免费的是模型权重,你可以下载、可以部署,但推理算力由你自己承担,一张H100的租金并没有消失。智谱涨价的是商业API服务,厂商代你承担了算力、运维和持续迭代成本,价格里包含的是一整条"开箱即用"的生产链。一个免费的是半成品材料,一个涨价的是成品服务,它们并不在同一条价格轴上竞争。

这两件事同时发生,并不矛盾。开源权重模型的免费策略,是为了建生态、抢标准;商业API服务的涨价策略,是为了活下来、证明商业模式。前者是战略性投入,后者是生存性选择。

对OpenAI而言,这形成了一种复杂局面:中国开放权重模型正在低成本市场形成竞争压力,而部分商业API服务则探索更高价值定位。OpenAI夹在中间:降价吧,中国开源模型比你更便宜;涨价吧,智谱正在证明"贵一点也有人买单"。


华尔街要看账本了

降价的在降价,涨价的在涨价。两件事凑到一起,问的其实是同一件事:这个行业的商业模式,到底能不能跑通?

OpenAI和Anthropic马上就要面对这个问题了。因为它们都在筹备上市。

OpenAI已于本周向美国证券交易委员会秘密提交了IPO申请奥特曼在内部Slack消息中说计划"一年内上市"。Anthropic也在走同样的路。价格竞争,可能成为这两家公司上市前需要面对的一项商业模式考验。

Gartner杰出副总裁分析师阿伦·钱德拉塞卡兰(Arun Chandrasekaran)对Business Insider的判断很直白:"这次价格竞争,可能是前沿AI实验室商业模式的一次早期测试。尤其是OpenAI最近秘密提交了IPO申请。"

说到底就是华尔街要看账本。降价能不能换来足够大的使用量?使用量能不能弥补利润率的压缩?这个故事,投资人买不买账?

不止OpenAI在焦虑,整个赛道都在转向。谷歌7月发布了三款新模型,主打的卖点就是比Kimi K3更便宜。微软CEO萨提亚·纳德拉(Satya Nadella)在季度财报电话会上,反复把"成本效率"挂在嘴边,称其为微软MAI-Thinking-1模型的"核心"。Anthropic新推出的Claude Opus 5,性能接近旗舰Fable 5,价格只要一半。

X上一位用户的评论称:"DeepSeek和Kimi K3打破的不只是OpenAI的能力护城河,还有它的定价地板。降价80%不是创新,是恐慌性打折。"


但如果只看价格跌幅就下结论,可能忽略了调价背后的结构设计。


OpenAI布的局:

塔尖的才值钱

回到OpenAI本身。降价背后,它其实在布一个更深的局。

细看这次调价:Luna降价80%,Terra降价20%,而Sol价格保持不变。这更像是一种分层定价策略,而非全面降价。

降价后,Luna的输入价格(20美分/百万token)已经低于DeepSeek V4 Pro(约43美分),逼近Kimi K3的缓存命中价。OpenAI总裁格雷格·布罗克曼(Greg Brockman)在X上写道:"Luna现在显然是同级别中最具性价比的模型。"


对开发者来说,这个价格意味着什么?独立开发者WolfMark Tools在X上算了一笔账:GPT-5.6 Luna的编程能力,已经接近此前许多用户使用的GPT-5.5高等级版本。而价格,只有后者的二十五分之一。

"对大多数开发者来说,问题不再是'我能负担得起AI编程智能体吗',而是'我为什么不找一个来用'。"他写道。


日本投资人国光宏尚认为,Luna可能被OpenAI定位为AI智能体时代的基础运行模型。足够聪明、足够便宜,可以7×24小时不间断运行。日常任务跑Luna,复杂任务上Terra,关键决策用Sol。一套"低中高"三级火力配置,第一次在价格上有了实战意义。


这套策略的潜台词是:OpenAI承认了低端市场的价格战现实,但它同时想证明,真正值钱的东西,在塔尖。

公平地说,OpenAI的效率提升并非全是话术。用Sol来优化自家模型的推理代码,让AI来降低AI的运行成本,这件事本身确实在发生。国光宏尚估算,GPU内核调优和推理环境优化帮OpenAI降低了约20%的服务成本。

但20%的成本节省,解释不了80%的降价。剩下的缺口,是中国开源模型用"免费"两个字生生撕开的。

布罗克曼在宣布降价时,说了一句意味深长的话:"期待看到你们用'便宜到不值得计价'的智能做出什么东西。"


"便宜到不值得计价"(too cheap to meter)。这个词脱胎于20世纪核电时代的著名口号:"电力会便宜到不值得装电表。"当一样东西便宜到你不再计算单次成本时,它的计价方式就彻底变了。


AI正在经历的时刻

中国开放权重模型带来的影响,不只是降低AI使用成本,也让行业重新思考按token销售智能的商业模式。X上一位用户写道:"中国没有仅仅降低中国AI的价格,它迫使整个行业降低了智能的价格。"


但智谱的涨价提醒了另一件事:好的智能,还是有人愿意付钱的。

当Kimi K3把前沿能力免费开放,当DeepSeek用不到5美元跑完一个完整编程任务,当智谱把Coding Plan从49块涨到118块、调用量反而翻了四倍。这三个事实摆在一起,指向的是同一个结论:

智能的定价方式正在分化:一部分走向更开放、更低成本,另一部分则通过高价值服务维持更高价格。

一半免费。一半更贵。

OpenAI想同时站在这两半上。这可能吗?

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
斯内德:当年欧冠夺冠后穆帅直接离开是对的,我也会那么做

斯内德:当年欧冠夺冠后穆帅直接离开是对的,我也会那么做

懂球帝
2026-09-09 03:28:06
英格兰公开赛:吴宜泽4-1晋级!32强中国10席,4大种子爆冷一轮游

英格兰公开赛:吴宜泽4-1晋级!32强中国10席,4大种子爆冷一轮游

小火箭爱体育
2026-09-08 22:06:27
17个月后欧盟大门或关闭,996就是强迫劳动,9成中小企业却还没醒

17个月后欧盟大门或关闭,996就是强迫劳动,9成中小企业却还没醒

浯江孤舟
2026-08-10 10:00:15
夫妻俩花12万做龙凤胎,被贵阳公司安排去广州取卵、移植,检测只怀单胎;公司:可以打掉重新移植

夫妻俩花12万做龙凤胎,被贵阳公司安排去广州取卵、移植,检测只怀单胎;公司:可以打掉重新移植

大风新闻
2026-09-08 18:39:25
大姨在劳务市场赚钱的路子有多广?网友:这钱活该大姨赚

大姨在劳务市场赚钱的路子有多广?网友:这钱活该大姨赚

娱乐圈见解说
2026-09-08 07:40:59
闰土太阳女主持和女歌手的瓜!

闰土太阳女主持和女歌手的瓜!

八卦疯叔
2026-09-09 09:10:03
泽连斯基拒特朗普!普京酝酿终极报复?俄乌和平彻底没戏?

泽连斯基拒特朗普!普京酝酿终极报复?俄乌和平彻底没戏?

瓦伦西亚月亮
2026-09-09 10:45:04
蒙古国政府再次公开拒绝了中方提出的跨境铁路运力扩容方案

蒙古国政府再次公开拒绝了中方提出的跨境铁路运力扩容方案

果妈聊娱乐
2026-08-23 08:38:03
日本女篮全队沮丧!跌出世界前十+连续12届无缘8强 日媒:三连败出局

日本女篮全队沮丧!跌出世界前十+连续12届无缘8强 日媒:三连败出局

颜小白的篮球梦
2026-09-09 08:02:13
1949年,宋庆龄问陈赓带多少兵,陈赓回答20万,宋庆龄感慨:林彪都80万了

1949年,宋庆龄问陈赓带多少兵,陈赓回答20万,宋庆龄感慨:林彪都80万了

历史龙元阁
2026-09-08 13:00:19
“学术纪委”耿同学落户杭州,获聘为浙江传媒学院特聘讲师

“学术纪委”耿同学落户杭州,获聘为浙江传媒学院特聘讲师

听心堂
2026-09-08 20:02:11
不充电也能跑千里!丰田第六代混动登场,国产混动迎来巨大挑战

不充电也能跑千里!丰田第六代混动登场,国产混动迎来巨大挑战

阿芒娱乐说
2026-09-09 05:37:29
井柏然在采访中称“我已经老了”,坦言听不懂网络用语,年轻人的梗需要专门查询才能理解

井柏然在采访中称“我已经老了”,坦言听不懂网络用语,年轻人的梗需要专门查询才能理解

韩小娱
2026-09-09 08:25:32
最新任免名单

最新任免名单

锡望
2026-09-08 14:13:36
女人见面的最高礼仪,就是穿裙子,这是对你的重视,对约会的重视

女人见面的最高礼仪,就是穿裙子,这是对你的重视,对约会的重视

加油丁小文
2026-09-01 07:09:58
东方卫视倪琳现任婚姻状况,网传嫁名人全是假的,真实生活太低调

东方卫视倪琳现任婚姻状况,网传嫁名人全是假的,真实生活太低调

一盅情怀
2026-09-09 10:54:38
终极冠军赛突调规则,严子怡面临巨大挑战,只投四轮,几乎“枪枪硬核”

终极冠军赛突调规则,严子怡面临巨大挑战,只投四轮,几乎“枪枪硬核”

智科社Neo
2026-09-09 06:49:30
德国一夜变天,欧洲集体恐慌!中国只回“两句话”,字字都是杀招

德国一夜变天,欧洲集体恐慌!中国只回“两句话”,字字都是杀招

趣文说娱
2026-09-08 10:35:59
GPT-6发布5天就被内部新模型超越

GPT-6发布5天就被内部新模型超越

硅屿手记
2026-09-09 09:32:11
女篮世界杯实力榜更新:中国队下降1名位居第7 法国超美国升至榜首

女篮世界杯实力榜更新:中国队下降1名位居第7 法国超美国升至榜首

罗说NBA
2026-09-08 19:43:23
2026-09-09 12:36:49
星海情报局 incentive-icons
星海情报局
关注“中国制造”的星辰大海
1434文章数 2031关注度
往期回顾 全部

科技要闻

AI重大突破!OpenAI称解开近百年数学难题

头条要闻

夫妻俩花12万做龙凤胎被安排去异地移植 检测只怀单胎

头条要闻

夫妻俩花12万做龙凤胎被安排去异地移植 检测只怀单胎

体育要闻

16年后再破门,被皇马放弃的少年没认输

娱乐要闻

郭麒麟最便宜贵公子争议,本人未回应

财经要闻

8月CPI同比涨0.8% PPI环比由降转涨

汽车要闻

坦克700申报信息曝光 长轴距版轴距增150mm/首搭6座

态度原创

本地
家居
房产
时尚
公开课

本地新闻

宁波,中国制造的隐藏大佬

家居要闻

2026建博会(广州) 公装联探展交流活动

房产要闻

砸388亿+首个方案出炉!三亚,又一片区要起飞!

我要是这样翻盘一次,能吹一辈子

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版