![]()
刚刚, 两条新闻几乎同时落地,小米MiMo,和罗福莉的前司DeepSeek模型“撞车了”。
9月8日下午,DeepSeek在群里发了一条通知:V4.1 Flash中间版本开始内测。
模型名deepseek-v4.1-flash-expires-on-0910,。
![]()
同一时间,小米官宣MiMo Desktop桌面版开放邀测,核心是“交付成果”,不是“回答问题”。
而且,邀测期间小米开放了两款新模型:MiMo-X-Pro-Preview和MiMo-X-Flash-Preview,主要面向专业工作场景优化,重点覆盖复杂任务推理、多Agent协作、大型编程项目、Office、网页设计、前端与交互设计、视频剪辑、3D生成、音乐生成及电脑操控等方向,但正式发布时间和定价均未公布。
![]()
一个把“临时”写进模型名,一个把愿景写进新闻稿。
两家同一天发动作,牌桌还是同一张。这不是巧合,而发给了两个曾经坐在同一张桌子边的人。
桌子叫DeepSeek,或者说,叫幻方系。而今天坐在这张桌子两端的,一个姓梁,另一个姓罗。
![]()
先说罗福莉。
小米MiMo大模型负责人。
她更早的身份是:DeepSeek-V2的MoE关键开发者之一。
DeepSeek-V2是什么?是这家公司“低价高能”叙事的起点,是后来一切"成本屠夫"故事的原文。
V2的MLA注意力架构、MoE的极致稀疏化,把推理成本压到一个让全行业失眠的刻度——这套东西,罗福莉在DeepSeek期间亲手参与写过。再往前,她在阿里达摩院主导过多语言预训练模型VECO,在幻方量化待过。
2025年11月,她加入小米。
两个月后,她在小米合作伙伴大会上首秀,发布MiMo-V2-Flash并全面开源——309B总参数,15B激活,推理成本是同类闭源竞品的2.5%。
这套打法,DeepSeek的用户看着眼熟。
小米挖她,挖的就是这份眼熟。
在“人车家全生态”的叙事里,小米缺一个能讲清AI的人;在雷军的排兵布阵里,缺一个从最凶残的价格战里走出来的人。
而罗福莉两头都占。
再看两个人各自的处境。
梁文锋这边,是数字垒起来的高墙。首轮融资超500亿落地,中国AI行业迄今最大单轮,他自己掏了200亿,持股约40%——最大单一出资方,把身家押上牌桌。
第二轮500亿重启,投前估值5000亿人民币,约合740亿美元,科创板IPO的传闻挂在头顶。
成立三年,DeepSeek这家公司从“不融资、不商业化”的传说,变成IPO倒计时里的主角。市场上曾流传它拒绝过顶级VC和科技巨头的一轮轮融资提议,如今那些拒绝,成了估值谈判桌上的筹码。
再看梁文锋的模型节奏:四个月,五步。
4月24日,V4预览版发布;
7月31日V4-Flash正式版API上线;
8月21日V4-Flash-Vision-Exp多模态版上线——注意,这个版本还是在文本架构外面挂了一个视觉模块,属于"外挂"。
8月31日,视觉版在Hugging Face开源;
9月8日,V4.1 Flash内测。
四个月里,DeepSeek完成了发布、转正、加模态、开源、换代五件事,中间还穿插了一次涨价和一次框架开源。这个节奏不像一家科研机构,更像一条流水线——研究、产品、价格、舆论,四班倒。
最近一次引发关注,是8月13日:DeepSeek宣布API涨价11倍,同时把Harness框架开源。
一边收割,一边布施。
就在8日下午,DeepSeek 开启了新模型 DeepSeek V4.1 Flash 的限时内测。
官方称,这是一个面向用户开放测试的中间版本,采用新的模型结构,原生支持多模态。按照 DeepSeek 给出的信息,新模型不仅能力更强、生成速度更快,使用成本也将进一步降低。
用户现在已经可以接入 API,原有的 base_url 无需修改,只要将模型名称设置为 deepseek-v4.1-flash-expires-on-0910,就能直接调用。
值得注意的是,V4.1 Flash 当前仍属于限时测试版本,表明该版本将在 9 月 10 日自动过期下线。
从名字看,它是一款 Flash 模型,但从 DeepSeek 的态度来看,它显然不只想做一个更快、更便宜的版本。比如在随测试一同开放的反馈问卷中,DeepSeek 直接向用户提问:
「你觉得这个模型能全面替换线上的 DeepSeek V4 Pro 么?」
Flash的模型,Pro的野心。
DeepSeek的狠,从来不是对别人,是对自己:DeepSeek真正想杀的是自家的 V4 Pro。便宜的新架构,什么时候能杀死贵的旧模型。
这个问题的答案,就是这家公司的下一个周期。
而罗福莉这边,今年3月,举行的中关村论坛AI开源前沿论坛上,她和Kimi杨植麟、智谱的张鹏、无问芯穹的夏立雪坐在同一张圆桌,聊的是OpenClaw。
她说,OpenClaw的最大价值在"开源",说"自进化将从概念走向落地"。三月,她说"给我五年"。
这个月,她又在访谈里说AGI"两年内应该能实现"。她的AGI倒计时,比房价涨得还快。
产品层面,MiMo-V2-Flash开源之后,是V2-Pro、是打通自动驾驶与具身智能的Embodied基座、是"人车家全生态"里每一个需要AI填空的角落。
这次推出的MiMo Desktop,是“桌面工作台”——接收多格式素材,理解目标,拆解任务,调用工具,交付成果。它甚至能自主控制浏览器,打开网页、检索信息、填写表单;生成的预览不是静态截图,而是带组件结构和交互逻辑的可点击页面。典型工作流写着:PPT场景,混合素材进去,叙事结构、图表版式出来。
这些能力真不真?大概率是真的。
但真正值得注意的是叙事本身——"交付成果"而非"回答问题"。
这句话的潜台词是:过去所有AI都在回答问题,而问题恰恰是,回答问题已经不够用了。
进入Agent时代,竞争核心从"谁更像人"转到"谁更能干活"。从Chat转向Agent,是她给MiMo定的调,也是小米给整个生态定的调。
但模型正在被自己造的Agent追着跑。
另一方面,小米和DeepSeek两家都崇尚开源,但开的是不同的东西。
DeepSeek开的不仅是模型,还有Harness——自己的Agent框架,MIT协议,GitHub上线几小时Star破三万;还有V4的视觉版权重。它的开源带着明确的战略意图:框架开源,生态占领,API卖钱,涨价也不怕用户跑,因为跑出去还是跑在它的生态里。
小米开的是MiMo-V2-Flash的权重——成本2.5%的性价比炸弹。
它的开源同样带着意图:生态里需要"自研大模型"这个名分,而开源是给这个名分做的最便宜的公证。
都是开源,一个在圈地,一个在立牌。
真正的对撞,藏在理想主义的账单里。
梁文锋承诺过“不以商业化为目标,只赚取合理利润”。同时,他实控的DeepSeek连同幻方量化、九章资产,在宇树科技IPO里战略配售加网下打新合计获配约119万股,其中DeepSeek作为战略投资者获配93万股,限售36个月,账面浮盈11亿。承诺和账单放在一起看,非常刺眼。
但这不是讽刺。恰恰相反,这是最诚实的地方:理想主义者也要交房租。5000亿估值、200亿自有资金、IPO倒计时、150个清一色工程岗的扩招。
克制的代价是具体数字。DeepSeek的克制不是性格,是处境。当一家公司开始被估值、被交割日期、被财报周期追赶,它所有的"不急",都会变成日历上的倒计时。
两天后,deepseek-v4.1-flash会准时下线、无声无息,像所有临时版本一样。但问卷里那个问题不会死:新的便宜的东西,什么时候能替掉旧的贵的东西。
这场对撞没有输赢。一个赌模型进化的速度,一个赌生态渗透的速度,就这样。
牌桌还在,但发牌的变成了当年同桌摸牌的两个人,如今各坐一端。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.