网易首页 > 网易号 > 正文 申请入驻

国产AI模型“无限战争”:Kimi刷新智能极限,DeepSeek当价格屠夫

0
分享至



没有一款AI模型能强大到无法超越,继续融资,继续“烧钱”。

©️懂财帝出品 · 作者|嘉逸

中国AI,把美股的估值逻辑干崩了。

华尔街坚信:AI模型越强,算力支出越高,烧钱越多。

但,Kimi、DeepSeek戳破了“泡沫”。去年初,DeepSeek R1凭借极低算力成本媲美GPT-4,英伟达股价单日暴跌近17%,市值蒸发5890亿美元。

近期,Kimi开源K3,以有限算力逼近Fable 5、GPT-5.6 Sol,Code Arena测评分数全球第一,一度干崩美股AI板块。

核心逻辑是:即便遭遇“算力瓶颈”,中国AI公司仍能取得突破(差距仅剩2-3个月)。那GPU还是唯一答案么?英伟达等AI基础设施的收入预期是否要下调?

对此,高盛合伙人在客户电话会里直言:算力扩张时代,可能到头了。

与此同时,Kimi还带崩了智谱——智谱创始人唐杰曾是Kimi创始人杨植麟的科研导师。Kimi正加速推进港股IPO,市场担忧智谱的“稀缺性”,短短两个交易日,股价跌超42%。



Kimi K3和杨植麟,竟然这么强?

01 | Kimi刷新“智能极限”,DeepSeek当价格屠夫

Kimi K3拿到了DeepSeek的剧本,撕裂硅谷。

白宫威胁,封禁外国开源AI模型。

近200家AI巨头、科技公司(微软、Meta、英伟达、Palantir等)随即联名致信警告:如果封禁中国开源模型,“将有数百家公司瞬间死亡。”英伟达CEO黄仁勋表示:美国公司“绝对应该被允许使用中国模型。”[1]



因为,Kimi K3和DeepSeek太强了。

Kimi K3刷新了“智能极限”,2.8万亿参数,MoE(混合专家)架构,896个专家中每次仅激活16个,100万token上下文,是目前全球最大的开源模型。

K3还创新了两项技术架构:

其一,KDA混合线性注意力,使KV缓存使用量减少了75%,在100万token上下文长度下解码吞吐量提升最高6倍。

其二,注意力残差(AttnRes),让AI模型有选择地跨层检索信息,有效解决信息稀释问题,大幅提升长程任务能力。

基于此,K3实现SOTA水平,跻身全球第一梯队,Artificial Analysis测试得分57,排名第三,仅次于Fable 5(60分)和GPT-5.6 Sol(59分)

Arena编码能力测试中,K3斩获1679分,超越所有美国AI模型,登顶全球第一。

同时,K3也更贵,定价对标海外顶级模型,百万tokens输入2元(缓存命中),输出100元,价格是K2.5的5倍。但API依然供不应求,以至于Kimi只能暂停C端新用户订阅。



与之对比,DeepSeek继续坚持“极致性价比”。

DeepSeek正灰度测试DeepSeek V4 Pro和V4 Flash。以V4 Pro为例,1.6万亿参数,490亿激活参数,MoE架构,100万token上下文,综合性能比肩Claude Opus 4.6 Max。

价格方面,DeepSeek首次引入“峰谷计费”:平时阶段,V4 Pro百万tokens输入0.025元(缓存命中),输出6元。高峰阶段翻倍,V4 Pro百万tokens输入0.05元(缓存命中),输出12元,但仍显著低于Kimi K3。

能看出,DeepSeek想要以同业10%的价格,提供顶级模型80%的AI能力。

综上,Kimi、DeepSeek蹚出了中国AI崛起的两条路:Kimi向上突破“智能天花板”,DeepSeek探索AGI,并不断向下突破使用成本。

02 | 两个AI天才,两种AI灵魂

Kimi、DeepSeek两次震撼全球,技术架构颇有默契。

Kimi K2、K3都采用了DeepSeek首创的MLA注意力机制,来削减KV缓存占用,解决内存困境。DeepSeek也借鉴了Kimi的技术经验,在V4模型中应用“二阶优化器Muon”,提升训练稳定性、模型扩展性等。

两家公司的组织环境和技术气质,亦高度相似。

DeepSeek像一个大型实验室,扁平、交叉分工、不加班。

Kimi的管理略有不同,但同样纯粹,极度热爱AI。一位熟悉Kimi的DeepSeek研究员表示,两家公司都有相似的技术理想,“如果Kimi老板看对了方向,可能比DeepSeek更快接近AGI。”[2]

Kimi创始人杨植麟和DeepSeek创始人梁文锋,也有很多共同点。

他们都是广东人,低调、务实、技术派。

有DeepSeek员工透露,梁文锋除了编程,没有什么其他的爱好[3]。近期的闭门会里,也能看到梁文锋对AI的深刻、独特理解。

杨植麟也是“技术狂”,他自己拆解技术架构,在社交媒体上和网友聊技术到凌晨3点。

技术路线方面,两人坚定支持开源模型,终极目标都是AGI。

梁文锋认为,“开源,发论文,其实并没有失去什么。”[3]“开源是属于我们这个规模公司的sweet point(甜蜜点)。”

DeepSeek不想做下一个字节、腾讯,不追C端流量、B端收入,“公司真正的长期目标是AGI,所有资源、所有决策都围绕‘提升AGI实现概率’这一核心指标。”[4]

杨植麟认为,开源AI加速探索智能上限。“通过开源,让企业、研究者、终端用户能低门槛获取智能,是非常重要的事。”

他在去年底的内部信中写道,“接下来公司最重要的目标是超越Anthropic等前沿公司成为世界领先的AGI公司。”

两人亦有不同,成长经历决定思考路径。

梁文锋毕业于浙大,是一位量化工程师,通过量化投资完成资本原始积累,再进阶AI研究。

他追求极致低成本,AI普惠,“无论是API,还是AI,都应该是普惠的、人人可以用得起的东西。”

因此,DeepSeek克制商业化,定价极低,V4 Pro高峰阶段的输入价(缓存命中)仅为K3的1/40。梁文锋表示,“只赚合理利润,不是利润最大化的定价。”

杨植麟比梁文锋年轻7岁,毕业于清华,尔后赴美留学,一直深耕AI领域,是可计算学派的笃信者。

在他看来,大模型的本质是“压缩产生智能”。在他的演讲、采访和内部信中,“突破、超越、AGI、智能上限”等词汇的出现频率较高。

两个AI天才,两种AI灵魂,造就了Kimi和DeepSeek的独特优势。最终,殊途同归,他们正加速推升AI模型的进化速率,冲击AGI。

03 | IPO盛宴,创造“万亿神话”?

AI无限战争,用户为两种模型买单:一是顶级模型,如Fable 5、GLM-5.2、Kimi K3。二是极致性价比模型,如DeepSeek。

Kimi、DeepSeek已驶入“增长快车道”。据公开资料,DeepSeek ARR约4亿—5亿美元。

Kimi 6月份ARR已超过3亿美元,API收入占比超过70%,K3发布后日销售量增加了6倍。



资本蜂拥而至,争相抢筹。截至目前,Kimi已完成8轮融资,融资规模超过600亿元人民币,估值350亿美元,股东阵容强大,包括:国资基金,如国家AI产业投资基金;顶级PE/VC,如红杉中国、IDG资本;科技巨头,如阿里、腾讯、美团。

DeepSeek已完成首轮融资,融资规模高达510亿元人民币,估值520亿美元,股东“明星云集”,国家AI产业投资基金、IDG资本、腾讯、京东、宁德时代......

但,没有一款AI模型能强大到无法超越。尤其对中国AI公司来说,对比海外同业,差距仍然存在,算力支出、资本扩张必须加码,钱仍然不够花。

融资狂潮继续,Kimi正推进Pre-IPO轮融资,目标估值500亿美元。

同时,Kimi已通知股东,正式启动VIE及红筹架构拆除工作,计划最快6个月内港股IPO。

DeepSeek也在抓紧筹钱,并期望留住核心人才,原计划推进第二轮融资,融资规模100亿元人民币,目标估值710亿美元,约4800亿元人民币。DeepSeek原计划在A股科创板上市,目标2027年挂牌。但目前已暂停。

未来,Kimi、DeepSeek能否和智谱一样,创造万亿市值神话?有待观察。

可以确认的是,AI故事终究要有“估值锚”,当他们站在资本市场“聚光灯”下,投资者便会进一步拷问预期:何时跑通商业化闭环?

当短期股价走势和长期AGI理想爆发冲突,杨植麟和梁文锋,Kimi和DeepSeek,还能否保持纯粹?

参考资料:

[1] Kimi K3,已经撕裂了整个硅谷-极客公园

[2] 知春路最有AGI理想的两个男人-白鲸实验室

[3] 我所见过的梁文锋-聪明投资者

[4] 读懂梁文锋:一群平凡的人做出了不平凡的事-中国蓝新闻

说明:数据源于公开披露,不构成任何投资建议,市场有风险,投资需谨慎。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
普京:我们原以为炼油厂是民用设施不会挨打,结果判断错了

普京:我们原以为炼油厂是民用设施不会挨打,结果判断错了

桂系007
2026-09-03 20:32:24
4年926万!官宣加盟骑士!哈登等到彩票大中锋

4年926万!官宣加盟骑士!哈登等到彩票大中锋

篮球实战宝典
2026-09-03 14:06:52
真爷们!张继科罕见回应景甜风波,一句话护尽前任体面,格局大了

真爷们!张继科罕见回应景甜风波,一句话护尽前任体面,格局大了

一盅情怀
2026-09-03 11:22:44
山西省委:坚决拥护党中央决定

山西省委:坚决拥护党中央决定

新京报
2026-09-03 20:29:07
井柏然翻红了?话不能说太早!

井柏然翻红了?话不能说太早!

影视地平线
2026-09-03 14:48:21
金正恩这步棋比清洗还狠!援俄刚打出威名,朝鲜军队高层一夜洗牌

金正恩这步棋比清洗还狠!援俄刚打出威名,朝鲜军队高层一夜洗牌

三毛看世界
2026-09-03 14:03:33
孟买和上海同是2000多万人口,孟买创造3100亿美元GDP,上海呢?

孟买和上海同是2000多万人口,孟买创造3100亿美元GDP,上海呢?

花小猫的美食日常
2026-09-04 00:07:54
36岁待业演员在河北一景区扮演“玄奘”走红;当事人回应:之前是影视演员,目前主要是游走互动和游客聊天

36岁待业演员在河北一景区扮演“玄奘”走红;当事人回应:之前是影视演员,目前主要是游走互动和游客聊天

封面新闻
2026-09-03 22:49:04
尊界“隔空关门”功能翻车?袁弘多次挥手车门没有反应,司机紧急救场:因为我挂档了

尊界“隔空关门”功能翻车?袁弘多次挥手车门没有反应,司机紧急救场:因为我挂档了

和讯网
2026-09-03 12:24:13
谢贤前女友Coco直播被说丑,本人回应:“姐都40岁了,把头发往下一放还是迷倒一大片的”

谢贤前女友Coco直播被说丑,本人回应:“姐都40岁了,把头发往下一放还是迷倒一大片的”

韩小娱
2026-09-04 05:54:22
后天起,入户调查!请积极配合

后天起,入户调查!请积极配合

河南交通广播1041
2026-09-03 13:55:37
驻俄大使馆开始“提醒”某些人了!

驻俄大使馆开始“提醒”某些人了!

走读新生
2026-09-03 11:48:48
难怪朱倩老公这次下手这么狠,这女人的聊天记录,实在是太野了

难怪朱倩老公这次下手这么狠,这女人的聊天记录,实在是太野了

皮蛋儿电影
2026-09-02 10:26:48
大S闺房曝光!太过诡异像灵堂引人不适,难怪大师预言她活不过50岁

大S闺房曝光!太过诡异像灵堂引人不适,难怪大师预言她活不过50岁

瞎说娱乐
2026-08-27 11:09:48
美网:中国三连胜!6-1,郑钦文强势五连胜晋级32强VS大满贯冠军

美网:中国三连胜!6-1,郑钦文强势五连胜晋级32强VS大满贯冠军

求球不落谛
2026-09-04 06:08:35
9月3日美网战报,2-0,2-1,2-1,中国金花晋级,三位大满贯晋级

9月3日美网战报,2-0,2-1,2-1,中国金花晋级,三位大满贯晋级

南海浪花
2026-09-04 04:19:14
王宝强携女友回工作室!38岁冯清腹部微凸引关注,相恋8年仍未婚

王宝强携女友回工作室!38岁冯清腹部微凸引关注,相恋8年仍未婚

神颜贩卖机
2026-09-03 15:04:16
恐慌性引援代价多大?纽卡亿元彩票直接作废

恐慌性引援代价多大?纽卡亿元彩票直接作废

看我说体育
2026-09-03 16:05:56
白金汉宫出手!梅根刚返英便失人心,温莎家族这招太绝了

白金汉宫出手!梅根刚返英便失人心,温莎家族这招太绝了

草莓解说体育
2026-09-04 00:40:03
马蓉直播哭穷,5000万快花光!金发造型寻找下一个“王宝强”?

马蓉直播哭穷,5000万快花光!金发造型寻找下一个“王宝强”?

八卦疯叔
2026-09-03 10:00:06
2026-09-04 07:11:00
懂财帝 incentive-icons
懂财帝
做最高效的投资者
1380文章数 6255关注度
往期回顾 全部

科技要闻

英伟达129亿美元拿下Hugging Face

头条要闻

男子逛夜市遭按摩摊大妈拉住 被5个大妈服务按到发红

头条要闻

男子逛夜市遭按摩摊大妈拉住 被5个大妈服务按到发红

体育要闻

梅西:巴萨10号与阿根廷10号

娱乐要闻

王宝强携女友回工作室!相恋8年仍未婚

财经要闻

章子怡套现3亿 上美拿什么补韩束的缺?

汽车要闻

限时权益价28.99万起 FREELANDER神行者8正式上市

态度原创

本地
艺术
亲子
公开课
军事航空

本地新闻

昆明的雨,解锁汪曾祺的浪漫雨季

艺术要闻

放大《汉宫春晓图》:撕掉宫斗剧滤镜,这才是明代深宫女子的真实日常

亲子要闻

孩子不长个,建议查查这四项

公开课

李玫瑾:为什么性格比能力更重要?

军事要闻

乌特工内战街头对射 互认对方为"俄特工"

无障碍浏览 进入关怀版