网易首页 > 网易号 > 正文 申请入驻

刚刚!杭州两大AI巨头发力:DeepSeek V4 Pro正式上线,阿里Qwen3.8首次开源

0
分享至


就在刚刚,国产开源AI大模型——尤其是杭州AI圈两大山脉迎来“双响炮”。

1、DeepSeek V4 Pro 正式版来了。

2、阿里 Qwen 团队正式开放性能最强的Qwen3.8-2.4T-A95B 模型权重。

而在海外,刚刚,马斯克的 SpaceXAI 正式发布 Grok 4.6,重点提升长时间运行的 Agent,以及更复杂的交互和视觉任务,在 Artificial Analysis Intelligence Index 拿到 61 分,与 GPT-5.6 Sol 持平,仅低于 Fable 5 的 62 分,性能已经追到第一梯队。


价格方面,Grok 4.6 每百万输入、输出 Token 分别为 2 美元和 6 美元,与 Grok 4.5 相同。GPT-5.6 Sol 则是 5 美元和 30 美元,也就是说 Grok 4.6 的输出价格只有 Sol 的 1/5。官方还提供速度更快的版本,价格翻倍。

但这个价格还是贵于DeepSeek。

果然还是梁圣!

随着海外持续进行开源和价格战,国内开源AI模型这套性价比路线的价值越来越大。


先看DeepSeek。

“DeepSeek V4 Pro 正式版已经更新至 API,调用模型名不变。新版本增强了 Agent 能力,支持 Responses API 和 Codex 接入,欢迎测试和反馈~”

刚刚官方在群里就发了这么一句话,和下面那张图。

根据DeepSeek“API文档”上的“模型&价格”页面中,模型版本新增了DeepSeek-V4-Pro-0813,其支持非思考与思考模式。


从目前公布的信息来看,deepseek-v4-pro 支持 1M 上下文长度,最大输出长度达到 384K Token,同时支持非思考模式和思考模式,其中思考模式默认开启,性能逼近最强的Claude Fable 5,与Opus 5性能相近。

两者的并发限制也有所区别。deepseek-v4-flash 的并发限制为 2500,deepseek-v4-pro 则为 500。

然而,当前API调用名称仍是 `deepseek-v4-pro`,上下文为 1M,最大输出 384K,Responses API 现在也已经标为支持。


价格层面,DeepSeek 此前发布公告,宣布计划近期整体上调 API 服务定价,现在靴子落定。

deepseek-v4-pro正式版当前每百万 Token 的价格分别为:缓存命中输入 0.025 元,缓存未命中输入 3 元,输出 6 元,与预览版几乎一致。

相比之下,deepseek-v4-flash 分别为 0.02 元、1 元和 2 元。

目前来看,DeepSeek-V4-Pro 的价格是V4 Flash正式版的3倍。

当然,性能上也无法比拟,但这个价格要比Qwen等模型,以及国外的GPT-5.6、Claude系列价格都要略低一些。


除了DeepSeek,杭州另一个兄弟——阿里也开源了。

刚刚,阿里Qwen团队宣布, 首次开源 Qwen-Max级别权重。

Qwen3.8-2.4T-A95B 模型总参数为 2.4T,每个 Token 激活 95B 参数,原生支持 262,144 Token 上下文,并可扩展至 1,010,000 Token。

值得一提的是,Qwen3.8-2.4T-A95B还是一个因果语言模型,模型每个 MoE 层包含 512 个专家,每个 Token 选择 10 个路由专家,并同时激活 1 个共享专家。

因此,Qwen3.8 延续 Qwen3.5 的混合架构,重点提升编程、办公、科研和长周期 Agent 任务的端到端完成能力。官方云端版 Qwen3.8-Max基于该开放权重模型,并加入更多生产环境能力。

官方公布的评测覆盖编程 Agent、通用 Agent、专业工作和长上下文等方向。

在官方所列评测中,Qwen3.8-Max 较 Qwen3.7-Max 在多项编程和通用 Agent 任务上提升明显;与 Opus 4.8、Fable 5 和 GPT 5.6 Sol 等模型相比,不同评测结果互有高低。

以模型卡的结果为例,Qwen3.8-Max 在 PaperBench 上得分 93.0,Terminal Bench 2.1 为 86.6,FrontierSWE 为 73.5,CoWorkBench 为 74.8。这些数据来自 Qwen 官方测试,且各评测的 Harness、超时时间、采样参数和上下文长度并不完全一致。


不过,开放版和云端 Qwen3.8-Max 并不完全一样。

官方模型卡写明,开源版原生支持 262K 上下文,可扩展到约 1M,并支持调节推理强度。当前版本只有文本输入,而且必须开启 Thinking。云端 Qwen3.8-Max 才额外支持视觉输入、非思考模式、默认 1M 上下文和官方内置工具。

许可证也不再是 Apache 2.0,而是 Qwen 自定义许可。普通用户仍可以下载、修改和部署,但部分大规模商业使用需要另行取得授权。

此前已经有消息指出,阿里计划开始向 Qwen3.8-Max 的大型商业用户设置额外收费或授权条件。

最后总结一下。

Qwen今年的战略是商业化,所以很多小模型都迟迟不开源。但DeepSeek-V4两个开源模型持续降价,以及Kimi K3的开源模型能力持续逼近海外水平,这促使阿里希望重启Qwen模型开源。

如果说 DeepSeek 补齐了商业化服务的短板,那 Qwen3.8-2.4T-A95B 的开源,则是给整个开发者社区扔下重磅红利。

过去万亿级 MoE 旗舰权重基本闭源锁死,中小团队、政企很难本地部署,如今阿里直接放开底层权重,意味着全行业都能基于这套顶尖底座做私有化二次开发,彻底打破高端模型只能云端调用的壁垒。

根据预告,Qwen3.8-27B也将会在近期公布,最快下月公布开源信息。

不同于过去只堆参数不顾成本的路线,DeepSeek 这套分层产品体系,证明国产模型已经能精准区分客户场景,用差异化定价降低企业使用高端算力的门槛,让百万字长文档、复杂逻辑推演不再是巨头专属。

这次两家同步发力,最难得的是路线完全互补,而非同质化内卷。DeepSeek 侧重云端 API 规模化服务,依靠分层定价、高并发承载企业线上生产流量,主打开箱即用的商用推理;Qwen则以开源权重为核心,也开始慢慢做商业化,否则会持续亏损。

放眼全球,海外巨头普遍只守闭源路线,极少开放旗舰权重;而国内一边有创业公司打磨云端服务,一边有大厂释放顶级模型底座,两条赛道同步成熟,不再单一依赖某一家企业、某一条技术路径,国产 AI 生态的抗风险能力、创新空间都大幅提升。

纵观这两款产品的同步落地,我的核心感受是:国产大模型正在发生黄仁勋所说的 “相变”,不再只是性能上的 “巨变”,而是底层规则、产业逻辑的彻底重构。

短期来看,两类产品会持续挤压海外闭源模型的国内市场空间;长期而言,开放权重以及平价云端服务的组合,会催生大量行业专属 AI、私有化算力项目。

这场双雄齐发不是一次短期热点,而是国产 AI 从技术追赶,转向自主构建产业生态的标志性拐点。

属于国产大模型的时代,已经真正到来。

©本文为原创内容

未经授权,禁止转载

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
10样东西过期1天也要扔!第一名家家都在用

10样东西过期1天也要扔!第一名家家都在用

三农老历
2026-09-09 02:09:07
领导干部任职前公示

领导干部任职前公示

锡望
2026-09-11 10:20:04
台湾阳明山发生情侣凶杀弃尸案 女子被找到时已成白骨

台湾阳明山发生情侣凶杀弃尸案 女子被找到时已成白骨

看看新闻Knews
2026-09-12 16:00:52
关于不予授予孔子同志正高级教师的批复

关于不予授予孔子同志正高级教师的批复

必记本
2026-09-12 10:53:14
68 岁大爷糖尿病恶化去世,从不饮酒!提醒:只因早上爱做 3 件事!

68 岁大爷糖尿病恶化去世,从不饮酒!提醒:只因早上爱做 3 件事!

叙说医疗健康
2026-09-12 06:00:17
国民党彻底乱套!宁可输掉2026大选,也要扳倒郑丽文?幕后水太深

国民党彻底乱套!宁可输掉2026大选,也要扳倒郑丽文?幕后水太深

时尚的弄潮
2026-09-12 11:37:27
澳门冠军赛:掀翻削球苦主终结连败!陈熠4-0韩莹,约战早田希娜

澳门冠军赛:掀翻削球苦主终结连败!陈熠4-0韩莹,约战早田希娜

钉钉陌上花开
2026-09-12 13:26:53
俄罗斯海军衰落了?俄媒公布1张最新照片,至少够中国追赶20年

俄罗斯海军衰落了?俄媒公布1张最新照片,至少够中国追赶20年

马探解说体育
2026-09-10 18:43:53
前线传来重磅消息!俄军击毙日本、美国、德国雇佣军,杀疯了

前线传来重磅消息!俄军击毙日本、美国、德国雇佣军,杀疯了

果妈聊娱乐
2026-09-10 10:18:30
中年的阿姨在家穿的这么时髦合适吗?我觉的很适合

中年的阿姨在家穿的这么时髦合适吗?我觉的很适合

美女穿搭分享
2026-09-12 10:00:55
罗杰斯:丢掉这2分让我们很难过,对手利用了我们的失误

罗杰斯:丢掉这2分让我们很难过,对手利用了我们的失误

懂球帝
2026-09-12 05:39:08
女单四强定2席:陈熠4-0终于战胜苦主,与早田希娜半决赛相遇

女单四强定2席:陈熠4-0终于战胜苦主,与早田希娜半决赛相遇

乒烧泳球
2026-09-12 13:29:32
不看脸依旧顶流!陈冠希英国坐地铁,万元穿搭穿出随性潮范

不看脸依旧顶流!陈冠希英国坐地铁,万元穿搭穿出随性潮范

乡野异闻录
2026-09-12 13:47:06
雷来了,昨晚17股利空,强制退市、摘牌退市、终止重组、股份减持

雷来了,昨晚17股利空,强制退市、摘牌退市、终止重组、股份减持

财经智多星
2026-09-12 08:01:03
我们不是普通公民!哈里梅根启动英美准王室公务,王室裂痕再升级

我们不是普通公民!哈里梅根启动英美准王室公务,王室裂痕再升级

手工制作阿歼
2026-09-12 01:15:38
大连市委书记调整

大连市委书记调整

新京报
2026-09-12 13:17:07
怪不得很多哈啰单车被扔河里!郑州男子骑600米仅5分钟被扣16.5元

怪不得很多哈啰单车被扔河里!郑州男子骑600米仅5分钟被扣16.5元

朗威谈星座
2026-09-12 12:53:26
李凯尔:中国男篮大部分球员都会英文,就赵继伟和周鹏不会说

李凯尔:中国男篮大部分球员都会英文,就赵继伟和周鹏不会说

懂球帝
2026-09-11 16:01:16
7家中国AI公司!近2亿次Claude交互,Anthropic又开始发疯式“点名”

7家中国AI公司!近2亿次Claude交互,Anthropic又开始发疯式“点名”

IT小埋
2026-09-11 23:46:47
1975年毛主席审批军区任职名单,看到王辉球职务后:把副职改成正职

1975年毛主席审批军区任职名单,看到王辉球职务后:把副职改成正职

凉州辞
2026-09-12 15:50:03
2026-09-12 16:32:49
智能纪元AGI
智能纪元AGI
专注科技、科学、商业产业报道
2611文章数 10612关注度
往期回顾 全部

科技要闻

苹果折叠屏比小米华为贵5000元,该怎么选

头条要闻

哈里夫妇返回英国 不满被国王信函定义为"普通公民"

头条要闻

哈里夫妇返回英国 不满被国王信函定义为"普通公民"

体育要闻

老鹰真正的底气来自于什么?

娱乐要闻

港媒曝钟丽淇疑患渐冻症,本人发文

财经要闻

继房子茅台后 中产的第3个"神话"破灭了

汽车要闻

全新配色和新样式轮毂 乐道L80星光设计套装限时惊喜价10080元

态度原创

艺术
教育
时尚
房产
军事航空

艺术要闻

211米!义乌第二高楼,封顶了

教育要闻

初中有零花钱和没零花钱的孩子,20年后差在哪?

专栏|一位“皮笑肉不笑”初学者的自述

房产要闻

别再等了!广州改善好房,正在进入“卖一套少一套”时代

军事要闻

胡塞武装:9天攻占5400平方公里

无障碍浏览 进入关怀版