网易首页 > 网易号 > 正文 申请入驻

Qwen3.8-27B爆火全球:本地大模型的“甜点位”到了

0
分享至



作者|林易

编辑|重点君

一个27B参数的模型,正在全球AI社区刷屏。

在今天Hugging Face最新Trending榜上,上周五开放权重的Qwen3.8-27B已经连续几日霸榜第一。按照官方最新统计,Qwen3.8-27B开源两天,全平台下载量便突破100万次;与此同时,社区已经贡献超过500个量化版本,相关模型总下载量超过500万次



除了HuggingFace官方数据之外,Qwen3.8-27B在全球社区里也已经是火得一塌糊涂。

有人把它塞进一张24GB显存的RTX 4090,在开启MTP的测试环境下跑到约65 tokens/s;SGLang当天就完成Day0支持,在单张RTX 5090的特定配置下给出206.1 tokens/s的Decode成绩。虽然两组测试条件完全不同、数字不能直接横比,但传递出来的信息已经比较清晰了,那就是27B已经落进了消费级显卡真正够得着的范围。



还有开发者干脆让Qwen3.8-27B现场写游戏。最后浏览器里真的跑出了一个国风庭院FPS,鼠标锁定、冲刺、换弹、战术瞄准一应俱全,玩家举着一把颇具东方审美的枪,在园林里打“瓷器无人机”。

美国知名开发者Alex Finn更是直接感叹“我们生活在一个新世界”,把Qwen3.8-27B形容成前沿模型能力开始进入个人电脑的标志;甚至有人编出了一则煞有介事的突发新闻,称Anthropic CEODario Amodei看到27B之后,紧急讨论限制措施。后者当然是网友恶搞的洋葱新闻,但也正因为足够像那么回事,才迅速变成了一场围绕开源与闭源模型的集体玩梗。





火爆归火爆,但现象背后的问题也就随之浮出水面:

为什么偏偏是27B?

如果我们把这场爆火只归因为模型更强,定然是解释不完、也解释不透的,沿着27B这个数字往下看,其实是一个正在上演的变化或趋势:

本地模型正在跨过“能跑”之后的第二道门槛——它们开始真的好用了。

27B,刚好卡在甜点位

提到本地大模型,其实放眼过去一段时间,这个词或多或少都会带着一点极客玩具的意味。

虽然把模型下载回来、量化、配环境、塞进显卡,折腾半天之后,它确实能在自己的电脑里回答问题。但一旦进入复杂Coding、长上下文、Agent调用,能力和前沿闭源模型的差距很快就会暴露出来。

所以云端API一直有一个非常直接的优势:更强。而Qwen3.8-27B引起关注的地方,恰恰是这条能力边界开始往下掉了。

按照Qwen官方介绍,它是一款27B参数的原生多模态Dense模型,原生上下文达到262K,同时重点强化了真实Coding和Office工作流,并采用Apache 2.0许可证开放权重。

而我们现在回头看Qwen团队选择27B这个尺寸,其实是有点微妙的说法在身上的。

原始精度当然依然需要不低的硬件配置,但经过4 bit等方式量化之后,模型已经能够进入24GB甚至更低显存区间。社区甚至已经有人围绕不同GGUF版本做起了横评,从8.5GB一路做到接近30GB,讨论的问题也从“到底能不能跑”,变成了“16GB显存到底选哪个量化档最划算”。

这其实是本地AI很关键的一次变化。电脑没有突然变成数据中心,前沿模型的参数规模也没有停止膨胀。发生变化的是,单位算力能够承载的智能密度正在快速提高。

放到最近一周的时间段来看,这种趋势尤其明显。

8月10日,Meta刚刚开放了30B参数的Muse Glimmer;随后英伟达也放出了Nemotron 3.5 Lightning 30B-A3B的完整权重及面向低延迟推理的版本。紧接着Qwen3.8-27B出现。Meta、英伟达、阿里几乎同时把筹码押到了30B上下这个区间。

背后的原因其实也不难理解。模型做得再大,普通开发者下载不了、部署不起,最终能接触到它的人还是少数。30B上下则提供了另一种可能,即能力继续向前顶、同时保住本地部署这条路。

Hugging Face在刚刚发布的State of Open Models: Summer 2026里,专门把“小模型仍然是实用层”列成了一条观察。其统计显示,超大模型能够拿到大量关注,但真正拥有广泛部署基础的,依然是能跑在开发者现有硬件上的模型。报告甚至提到,本地推理过去通常意味着“笔记本上的8B模型”,如今随着llama.cpp、GGUF和量化生态成熟,这个天花板正在飞速抬高。



于是,Qwen3.8-27B踩中了一个非常特殊的时间点。往小了做,能力还很难覆盖越来越复杂的Agent和Coding任务;继续往百B、千B走,又会迅速脱离个人设备。27B刚好挤在两条曲线之间:一边是越来越接近前沿水平的能力,另一边是仍然能够承受的硬件成本。

这也解释了为什么海外开发者会出现“本地Opus”这类颇为夸张的评价。它们当然不能替代严谨的第三方评测,但这种情绪本身值得关注。

因为开发者兴奋的东西已经发生了变化。几年前大家讨论本地模型,先问“能跑吗”;后来变成“效果怎么样”;到了今天,问题又往前走了一步:一个27B模型,究竟已经能在个人设备上把能力做到什么程度?

如此实际的问题,或许对于开发者来说,比任何一张Benchmark表都更有杀伤力。

爆款背后是开源生态的复利

不过对于27B这个尺寸,我们仍然只解释了一半。

因为就在Qwen3.8-27B附近,Meta有30B,英伟达也有30B。那为什么Qwen能够在短时间里引发如此密集的量化、适配和二次开发?

答案或许藏在模型发布后的那几小时里。

Qwen3.8-27B刚开源,SGLang就宣布Day0支持;随后硬件、推理框架、本地工具和量化社区迅速跟进,从英伟达、AMD、平头哥、沐曦、联发科、摩尔线程,一直延伸到vLLM、SGLang、Ollama、LM Studio等工具。甚至连当红“炸子鸡”AI芯片及推理平台Cerebras,也要来适配Qwen3.8对外提供服务了。



这时候,一个模型的发布已经很难被理解成“官方上传了一份权重”。权重出现,社区马上量化;量化版本出现,本地推理框架接住;硬件厂商开始优化;开发者拿去跑Coding、做Agent、搭应用,又产生新的模型、新的工具和新的教程。

这套链条一旦转起来,模型的生命就开始脱离发布者本身。

Hugging Face最新报告里有一个很有意思的数据。在Hub上,Qwen相关GGUF模型每月已经产生约3960万次下载,接近Gemma的两倍,是Llama的5倍以上。更值得注意的是,Qwen和Llama的GGUF仓库数量其实相差没有那么悬殊,真正拉开差距的是这些仓库被使用的频率。



这也是Hugging Face为什么会在报告中单独给出一个判断:

Qwen has become the community's base model。(Qwen已经成为社区的基座模型)



按照其统计,目前Hugging Face上基于Qwen构建的衍生模型达到151448个,是Meta整体模型衍生规模的2.6倍、Llama仓库的4.7倍。不仅如此,今年前7个月,新的Qwen衍生仓库仍然保持着每天约180到210个的增长速度。

而这些模型,绝大部分甚至并非Qwen团队自己制作。报告统计的151448个衍生模型,本质上是全球开发者在Qwen上继续训练、微调、量化和改造出来的结果;光GGUF转换版本就有28531个,其中Qwen官方自己只发布了54个。

开源的复利就在这里。一个模型吸引更多开发者,开发者创造更多衍生版本;更多衍生版本覆盖更多硬件和场景,又继续降低后来者的使用门槛。到最后,大家选择Qwen的理由里,模型本身的能力仍然重要,但“别人已经把周边都做好了”也开始成为原因。

Hugging Face把Qwen形成这种位置的原因归结为三个因素:持续迭代、尺寸覆盖和开放程度。Qwen很少只押一款旗舰,从1B以下的小模型一路覆盖到27B,再到2.4T的Max;大部分开发者熟悉的模型又采用Apache 2.0等相对宽松的许可证。一个开发者今天需要本地小模型,明天需要27B,后天准备做服务器部署,都可以继续待在同一套家族里。

还有一组数据,也可以开始体现这种全尺寸覆盖的价值。

2026年前7个月,在Hugging Face有明确参数规模的仓库中,Qwen累计下载达到约20.45亿次;Moonshot以超大模型为主的产品组合同期约3700万次,两者相差约55倍。Hugging Face把它们概括成两种不同的打法:一种更押注前沿模型和API需求,另一种则试图覆盖完整尺寸谱系,争夺开发者最终会标准化在哪个模型家族上。

再回过头看Qwen3.8-27B这两天的爆火,事情就有了另一层解释。

27B只是恰好来到了一个能力、成本和硬件条件同时合适的位置,于是Qwen过去几年铺开的开源网络,在这里集中释放了一次。过去模型行业最容易比较的是参数、Benchmark和API价格。现在又多了一个更难短期追赶的指标——当一个新模型发布时,有多少人会主动帮你把它变成真正能用的东西。

这可能才是“基座模型”四个字最重的部分。

开源开始找到商业闭环路径

当然,生态越大,另一个问题也越难绕开。

训练最前沿模型依然是一门烧钱的生意。如果开放权重只意味着持续投入,却无法形成回报,那么再热闹的社区也需要回答一个长期问题——谁来为下一代模型买单?

Qwen3.8这次其实同时给出了两种选择。

27B依然使用Apache 2.0,把门槛尽可能压低,让个人开发者和企业能够下载、修改、部署。另一头,2.4T参数的Qwen3.8-2.4T-A95B也开放了权重,却采用专门的Qwen3.8-Max License。按照目前官方License,当商业产品月活超过1亿或月收入超过2000万美元时,需要在界面显著展示相应模型名称;从事Model-as-a-Service或AI Work Assistant业务、且关联主体连续12个月总收入超过5000万美元时,则需要另行取得商业许可。

这套规则针对的显然不是个人开发者。一个2.4T参数模型,即便权重完全公开,大部分个人也没有条件把它完整部署起来。真正具备这种能力的,往往已经是大型云平台、API服务商或者具备相当基础设施能力的企业。

开源到了这里,也出现了新的商业空间。一些海外企业因为合规、安全和地缘政治等因素,未必愿意直接调用中国模型厂商提供的官方API;开放权重以后,当地平台可以自行完成部署,再向本地客户提供服务。对于超大模型而言,这种路径打开的商业空间,已经超出了单纯给自家云服务导流。

Hugging Face的报告也观察到了相似变化。过去中国开放模型普遍使用相当宽松的MIT、Apache 2.0协议,而最近Kimi K3、Qwen3.8这类超大模型开始出现更明确的商业条款。开放权重创造的价值,也正在向API、云服务、硬件、平台和生态位置等更多环节积累。

于是,一大一小两款Qwen3.8放在一起,反倒很能说明今天开源模型正在发生什么。27B尽可能进入更多人的电脑,把开发者、工具和应用吸引进来;Max继续把能力边界向上推,同时探索超大模型怎样获得商业回报。中间则是不断增加的量化版本、推理框架、硬件适配和衍生模型。

最终,一次模型的发布,开始变成了一个循环。

这或许也是Qwen3.8-27B突然冲上Hugging Face热榜之后,更值得关注的地方。

今天大家看到的是一款27B模型在RTX 4090上跑起来,有人拿它写代码,有人用它造游戏,还有人为了它在X上编起了Dario的段子。

再往后看一步,开源模型之间真正拉长的竞争,可能会越来越少取决于“这一代谁多赢了几个Benchmark”。谁能让更多开发者把模型下载下来,真正装进自己的电脑;谁能让框架、芯片和工具在发布当天就接住它;谁又能让这些开发者继续留下来,在上面创造下一万个模型和应用——

这才决定了一款模型究竟是火几天,还是最终成为一整个繁荣生态的地基。

[1]https://huggingface.co/models

[2]https://x.com/Alibaba_Qwen/status/2088280182356611304

[3]https://x.com/sgl_project/status/2088281320422322413

[4]https://x.com/analogalok/status/2088326480669667699

[5]https://x.com/MaziyarPanahi/status/2088616278470570400

[6]https://huggingface.co/blog/state-of-open-models-summer-2026

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
《街霸》电影春丽演员苦练大腿!每天狂吃12个鸡蛋

《街霸》电影春丽演员苦练大腿!每天狂吃12个鸡蛋

3DM游戏
2026-08-29 11:32:21
环球时报快评:集体撤展!一个中国原则不容挑战

环球时报快评:集体撤展!一个中国原则不容挑战

环球网资讯
2026-09-03 16:03:07
韩媒:BLACKPINK成员朴彩英拒绝100亿韩元“中国奶茶”的代言邀约

韩媒:BLACKPINK成员朴彩英拒绝100亿韩元“中国奶茶”的代言邀约

情感大头说说
2026-09-03 14:28:55
早上10点!CCTV5直播男篮亚运会揭幕战,取胜难度不大,19岁新星欲迎首秀

早上10点!CCTV5直播男篮亚运会揭幕战,取胜难度不大,19岁新星欲迎首秀

篮球圈里的那些事
2026-09-03 14:59:52
救母骨髓配型发现非亲生,女子崩溃发帖求助:我从哪里来

救母骨髓配型发现非亲生,女子崩溃发帖求助:我从哪里来

扬子晚报
2026-09-02 22:17:30
四川一考生远赴211报到,住一晚就退学,学费已缴,本人回应:忽然醒悟了

四川一考生远赴211报到,住一晚就退学,学费已缴,本人回应:忽然醒悟了

育学笔谈
2026-09-03 13:46:33
今年,北京太惨了。。。

今年,北京太惨了。。。

纯洁的微笑
2026-09-03 12:24:06
许多演员不和孙俪合作的原因,刘涛早就说过她太细节控了

许多演员不和孙俪合作的原因,刘涛早就说过她太细节控了

财叔
2026-09-03 09:21:42
大三女儿暑假躺平40天,空调24小时不关奶茶30多一杯,我月薪几千省吃俭用,她张口又要3000旅游,我拒绝她摔门就走

大三女儿暑假躺平40天,空调24小时不关奶茶30多一杯,我月薪几千省吃俭用,她张口又要3000旅游,我拒绝她摔门就走

背包旅行
2026-09-01 11:59:19
美股三大指数集体高开 Snowflake大涨超23%

美股三大指数集体高开 Snowflake大涨超23%

每日经济新闻
2026-09-03 21:37:03
中国足球等了二十年,终于等来了一个真正会踢右后卫的人

中国足球等了二十年,终于等来了一个真正会踢右后卫的人

中场阴谋家
2026-09-03 22:46:22
泽连斯基向全球下通告:谁敢飞俄罗斯,乌军的无人机可不长眼

泽连斯基向全球下通告:谁敢飞俄罗斯,乌军的无人机可不长眼

影孖看世界
2026-09-03 23:56:42
一句“没本事才来送外卖”,这位女老师把自己的饭碗砸了!

一句“没本事才来送外卖”,这位女老师把自己的饭碗砸了!

皮蛋儿电影
2026-09-02 10:11:24
52岁黄渤骑车摔倒骨折住院,本人回应:这回算是用自己的锁骨换了个提醒,骑车千万不能一心二用,等我好了还要接着骑,安安全全地骑

52岁黄渤骑车摔倒骨折住院,本人回应:这回算是用自己的锁骨换了个提醒,骑车千万不能一心二用,等我好了还要接着骑,安安全全地骑

潇湘晨报
2026-09-03 21:58:15
一只值100元!成都农户深夜狂抓6156只被查获,总价值高达60多万

一只值100元!成都农户深夜狂抓6156只被查获,总价值高达60多万

阿讯说天下
2026-09-02 11:45:24
强势归来!郑钦文逆风书写历史,三战全胜零封劲敌

强势归来!郑钦文逆风书写历史,三战全胜零封劲敌

寒士之言本尊
2026-09-01 18:04:56
iPhone 18 Pro 即将发布!售价提前曝光,大幅度涨价

iPhone 18 Pro 即将发布!售价提前曝光,大幅度涨价

XCiOS俱乐部
2026-09-03 19:52:15
“养条狗都比你强!”老公主在雨中崩溃痛哭,评论区里没有一点同情!

“养条狗都比你强!”老公主在雨中崩溃痛哭,评论区里没有一点同情!

林林先生
2026-09-03 11:14:07
2亿!2亿啊!重磅签约!火箭的第三大巨头

2亿!2亿啊!重磅签约!火箭的第三大巨头

篮球实战宝典
2026-09-03 23:16:28
宝马炮轰比亚迪背后真相:若闪充不伤电池,就不需要固态电池了!

宝马炮轰比亚迪背后真相:若闪充不伤电池,就不需要固态电池了!

阿芒娱乐说
2026-09-03 00:51:58
2026-09-04 01:16:49
划重点KeyPoints incentive-icons
划重点KeyPoints
去除噪音,划下重点
277文章数 18关注度
往期回顾 全部

科技要闻

英伟达129亿美元拿下Hugging Face

头条要闻

男子逛夜市遭按摩摊大妈拉住 被5个大妈服务按到发红

头条要闻

男子逛夜市遭按摩摊大妈拉住 被5个大妈服务按到发红

体育要闻

梅西:巴萨10号与阿根廷10号

娱乐要闻

王宝强携女友回工作室!相恋8年仍未婚

财经要闻

章子怡套现3亿 上美拿什么补韩束的缺?

汽车要闻

限时权益价28.99万起 FREELANDER神行者8正式上市

态度原创

亲子
本地
手机
数码
公开课

亲子要闻

为啥新手妈妈总盯宝宝便便?看懂,3,种便便,就懂消化

本地新闻

昆明的雨,解锁汪曾祺的浪漫雨季

手机要闻

8月性价比最高入门机榜单出炉:摩托罗拉霸榜前2

数码要闻

AMD肾上腺素驱动26.9.1可选更新发布

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版