网易首页 > 网易号 > 正文 申请入驻

刚刚!DeepSeek V4 Pro正式上线,杭州另一头阿里Qwen3.8首次开源

0
分享至



就在刚刚,国产开源AI大模型——尤其是杭州AI圈两大山脉迎来“双响炮”。

1、DeepSeek V4 Pro 正式版来了。

2、阿里Qwen 团队正式开放性能最强的Qwen3.8-2.4T-A95B 模型权重。

而在海外,刚刚,马斯克的SpaceXAI 正式发布 Grok 4.6,重点提升长时间运行的 Agent,以及更复杂的交互和视觉任务,在 Artificial Analysis Intelligence Index 拿到 61 分,与 GPT-5.6 Sol 持平,仅低于 Fable 5 的 62 分,性能已经追到第一梯队。



价格方面,Grok 4.6 每百万输入、输出 Token 分别为 2 美元和 6 美元,与 Grok 4.5 相同。GPT-5.6 Sol 则是 5 美元和 30 美元,也就是说 Grok 4.6 的输出价格只有 Sol 的 1/5。官方还提供速度更快的版本,价格翻倍。

但这个价格还是贵于DeepSeek。

果然还是梁圣!

随着海外持续进行开源和价格战,国内开源AI模型这套性价比路线的价值越来越大。



先看DeepSeek。

“DeepSeek V4 Pro 正式版已经更新至 API,调用模型名不变。新版本增强了 Agent 能力,支持 Responses API 和 Codex 接入,欢迎测试和反馈~”

刚刚官方在群里就发了这么一句话,和下面那张图。

根据DeepSeek“API文档”上的“模型&价格”页面中,模型版本新增了DeepSeek-V4-Pro-0813,其支持非思考与思考模式。



从目前公布的信息来看,deepseek-v4-pro 支持 1M 上下文长度,最大输出长度达到 384K Token,同时支持非思考模式和思考模式,其中思考模式默认开启,性能逼近最强的Claude Fable 5,与Opus 5性能相近。

两者的并发限制也有所区别。deepseek-v4-flash 的并发限制为 2500,deepseek-v4-pro 则为 500。

然而,当前API调用名称仍是 `deepseek-v4-pro`,上下文为 1M,最大输出 384K,Responses API 现在也已经标为支持。



价格层面,DeepSeek 此前发布公告,宣布计划近期整体上调 API 服务定价,现在靴子落定。

deepseek-v4-pro正式版当前每百万 Token 的价格分别为:缓存命中输入 0.025 元,缓存未命中输入 3 元,输出 6 元,与预览版几乎一致。

相比之下,deepseek-v4-flash 分别为 0.02 元、1 元和 2 元。

目前来看,DeepSeek-V4-Pro 的价格是V4 Flash正式版的3倍。

当然,性能上也无法比拟,但这个价格要比Qwen等模型,以及国外的GPT-5.6、Claude系列价格都要略低一些。



除了DeepSeek,杭州另一个兄弟——阿里也开源了。

刚刚,阿里Qwen团队宣布,首次开源Qwen-Max级别权重。

Qwen3.8-2.4T-A95B模型总参数为 2.4T,每个 Token 激活 95B 参数,原生支持 262,144 Token 上下文,并可扩展至 1,010,000 Token。

值得一提的是,Qwen3.8-2.4T-A95B还是一个因果语言模型,模型每个 MoE 层包含 512 个专家,每个 Token 选择 10 个路由专家,并同时激活 1 个共享专家。

因此,Qwen3.8 延续 Qwen3.5 的混合架构,重点提升编程、办公、科研和长周期 Agent 任务的端到端完成能力。官方云端版 Qwen3.8-Max基于该开放权重模型,并加入更多生产环境能力。

官方公布的评测覆盖编程 Agent、通用 Agent、专业工作和长上下文等方向。

在官方所列评测中,Qwen3.8-Max 较 Qwen3.7-Max 在多项编程和通用 Agent 任务上提升明显;与 Opus 4.8、Fable 5 和 GPT 5.6 Sol 等模型相比,不同评测结果互有高低。

以模型卡的结果为例,Qwen3.8-Max 在 PaperBench 上得分 93.0,Terminal Bench 2.1 为 86.6,FrontierSWE 为 73.5,CoWorkBench 为 74.8。这些数据来自 Qwen 官方测试,且各评测的 Harness、超时时间、采样参数和上下文长度并不完全一致。



不过,开放版和云端 Qwen3.8-Max 并不完全一样。

官方模型卡写明,开源版原生支持 262K 上下文,可扩展到约 1M,并支持调节推理强度。当前版本只有文本输入,而且必须开启 Thinking。云端 Qwen3.8-Max 才额外支持视觉输入、非思考模式、默认 1M 上下文和官方内置工具。

许可证也不再是 Apache 2.0,而是 Qwen 自定义许可。普通用户仍可以下载、修改和部署,但部分大规模商业使用需要另行取得授权。

此前已经有消息指出,阿里计划开始向 Qwen3.8-Max 的大型商业用户设置额外收费或授权条件。

最后总结一下。

Qwen今年的战略是商业化,所以很多小模型都迟迟不开源。但DeepSeek-V4两个开源模型持续降价,以及Kimi K3的开源模型能力持续逼近海外水平,这促使阿里希望重启Qwen模型开源。

如果说 DeepSeek 补齐了商业化服务的短板,那 Qwen3.8-2.4T-A95B 的开源,则是给整个开发者社区扔下重磅红利。

过去万亿级 MoE 旗舰权重基本闭源锁死,中小团队、政企很难本地部署,如今阿里直接放开底层权重,意味着全行业都能基于这套顶尖底座做私有化二次开发,彻底打破高端模型只能云端调用的壁垒。

根据预告,Qwen3.8-27B也将会在近期公布,最快下月公布开源信息。

不同于过去只堆参数不顾成本的路线,DeepSeek 这套分层产品体系,证明国产模型已经能精准区分客户场景,用差异化定价降低企业使用高端算力的门槛,让百万字长文档、复杂逻辑推演不再是巨头专属。

这次两家同步发力,最难得的是路线完全互补,而非同质化内卷。DeepSeek 侧重云端 API 规模化服务,依靠分层定价、高并发承载企业线上生产流量,主打开箱即用的商用推理;Qwen则以开源权重为核心,也开始慢慢做商业化,否则会持续亏损。

放眼全球,海外巨头普遍只守闭源路线,极少开放旗舰权重;而国内一边有创业公司打磨云端服务,一边有大厂释放顶级模型底座,两条赛道同步成熟,不再单一依赖某一家企业、某一条技术路径,国产 AI 生态的抗风险能力、创新空间都大幅提升。

纵观这两款产品的同步落地,我的核心感受是:国产大模型正在发生黄仁勋所说的 “相变”,不再只是性能上的 “巨变”,而是底层规则、产业逻辑的彻底重构。

短期来看,两类产品会持续挤压海外闭源模型的国内市场空间;长期而言,开放权重以及平价云端服务的组合,会催生大量行业专属 AI、私有化算力项目。

这场双雄齐发不是一次短期热点,而是国产 AI 从技术追赶,转向自主构建产业生态的标志性拐点。

属于国产大模型的时代,已经真正到来。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
自导自演“打磨芯片”栽赃华为,被光速打脸后,那照妖镜照出了谁

自导自演“打磨芯片”栽赃华为,被光速打脸后,那照妖镜照出了谁

潋滟晴方DAY
2026-09-05 14:42:12
CCTV5直播,中国男篮VS哈萨克斯坦,赢球不难,郭士强做好三件事

CCTV5直播,中国男篮VS哈萨克斯坦,赢球不难,郭士强做好三件事

体坛小快灵
2026-09-10 10:17:47
1.17 亿血赚!切尔西新王封神一战!名宿彻底看傻眼

1.17 亿血赚!切尔西新王封神一战!名宿彻底看傻眼

澜归序
2026-09-10 09:41:16
股价暴跌95%、两位CEO下台,这家5000亿巨头在10年后“活过来”了

股价暴跌95%、两位CEO下台,这家5000亿巨头在10年后“活过来”了

钛媒体APP
2026-09-07 17:19:07
卫星图像显示,在美国战争威胁下,伊朗“镐山”核设施建设激增

卫星图像显示,在美国战争威胁下,伊朗“镐山”核设施建设激增

泪满过眼
2026-09-10 09:39:08
限时“秋凉”将到期,明起气温回升30℃以上区域增多

限时“秋凉”将到期,明起气温回升30℃以上区域增多

北青网-北京青年报
2026-09-10 09:29:07
iPhone Duo 大圆角设计真丑!黔驴技穷,苹果早就不行了

iPhone Duo 大圆角设计真丑!黔驴技穷,苹果早就不行了

喜爱的CAD
2026-09-10 10:42:16
台湾方面频繁针对爱奇艺、小红书、螺蛳粉、张雪机车及瑞幸咖啡等入台进行严格审查,国台办:是不得人心的政治操弄

台湾方面频繁针对爱奇艺、小红书、螺蛳粉、张雪机车及瑞幸咖啡等入台进行严格审查,国台办:是不得人心的政治操弄

政知新媒体
2026-09-09 14:04:45
欧冠上演英超西甲焦点大战:6.8亿豪门1-2被逆转 惨遭死敌5连斩

欧冠上演英超西甲焦点大战:6.8亿豪门1-2被逆转 惨遭死敌5连斩

狍子歪解体坛
2026-09-10 04:57:39
谢婷婷罕见发声,揭开前嫂子张柏芝真面目,与网络传言天差地别

谢婷婷罕见发声,揭开前嫂子张柏芝真面目,与网络传言天差地别

看尽落尘花q
2026-08-04 15:28:11
刘翔晒工资明细:退役11年合计98万元,月均7000元

刘翔晒工资明细:退役11年合计98万元,月均7000元

南方都市报
2026-09-10 14:03:20
房地产的中产阶级,正在消失

房地产的中产阶级,正在消失

地产大爆炸
2026-09-09 21:47:15
金砖峰会将开幕,普京已确定参会,印度放出风声,对中国有事相求

金砖峰会将开幕,普京已确定参会,印度放出风声,对中国有事相求

三石记
2026-09-09 13:29:36
拉夫罗夫向全球交底:中俄永不结盟,俄罗斯绝不当中国小跟班

拉夫罗夫向全球交底:中俄永不结盟,俄罗斯绝不当中国小跟班

精彩启程
2026-09-10 13:01:06
前苏联外交官回忆:1949年高岗访苏,曾建议斯大林将东北纳入苏联版图

前苏联外交官回忆:1949年高岗访苏,曾建议斯大林将东北纳入苏联版图

凉州辞
2026-09-10 06:00:03
东莞通报:高伟文严重违纪违法,被开除党籍和公职

东莞通报:高伟文严重违纪违法,被开除党籍和公职

南方都市报
2026-09-10 14:18:31
研究员评价麒麟9050 Pro:达到了一个制程落后,但性能领先的格局。不过逻辑折叠只是增效方案,我们需要突破先进制程

研究员评价麒麟9050 Pro:达到了一个制程落后,但性能领先的格局。不过逻辑折叠只是增效方案,我们需要突破先进制程

逍遥漠
2026-09-09 11:43:02
这是啥安排?女篮扛旗人2场不打,球迷:留在板凳做思想工作吗?

这是啥安排?女篮扛旗人2场不打,球迷:留在板凳做思想工作吗?

南海浪花
2026-09-10 07:24:32
甜美女神金晨:美若天仙,国色天香。沉鱼落雁,闭月羞花!

甜美女神金晨:美若天仙,国色天香。沉鱼落雁,闭月羞花!

十为先生
2026-09-10 14:26:53
我85岁才明白:永远不要在兄弟姐妹面前,随口说出5句话,切记

我85岁才明白:永远不要在兄弟姐妹面前,随口说出5句话,切记

黄家湖的忧伤
2025-07-04 17:25:58
2026-09-10 15:56:49
智能纪元AGI
智能纪元AGI
专注科技、科学、商业产业报道
2606文章数 10612关注度
往期回顾 全部

科技要闻

一文看懂:iPhone折叠屏顶配2万6,10月才卖

头条要闻

22岁女子与男友吵架后投江身亡:生前被迫写"卖身契"

头条要闻

22岁女子与男友吵架后投江身亡:生前被迫写"卖身契"

体育要闻

一年丢掉的积分排名,郑钦文用18天找回来

娱乐要闻

郭德纲被处罚2天,身边人传出好消息

财经要闻

重磅!金融强国建设“十五五”规划出台

汽车要闻

腾势Z9GT易三方闪充尊越型32.98万元上市

态度原创

手机
教育
亲子
旅游
时尚

手机要闻

果链新成员!领益智造供货iPhone Duo铰链、超薄均热板等核心结构件

教育要闻

刘鹓看望慰问一线教师

亲子要闻

辅酶q10对备孕有什么效果?促排期间吃什么提高卵泡发育?

旅游要闻

视频丨“这里太棒了!”英国博主来华观光后强烈推荐“中国游”

女人不管多大,都可以看看这些“条纹T恤”,非常减龄又简约

无障碍浏览 进入关怀版