随手先关注,不错过每日AI热讯速递
①
8月28日,腾讯混元发布并开源旗舰大模型Hy4 preview。[2]这是混元自今年2月重建训练基础设施以来发布的第三个大版本。
上一代Hy3总参数295B、激活21B、上下文262K,Hy4 preview把这三项指标全部翻倍以上:总参数770B、激活49B、上下文1M token。[2]
模型采用MoE(混合专家模型:把模型分成大量“专家”子网络,每次推理只激活其中一小部分)架构。主干78层,第一层为稠密层,其余77层为MoE路由。[1]
每层256个路由专家加1个共享专家,每个token激活top-8路由专家。注意力机制为Gated DeepSeek Sparse Attention。[1]
![]()
图:腾讯混元Hy4 preview官方GitHub仓库README中的benchmark对比表,多模型横向分数对比(来源:GitHub[1])
②
Hy4 preview最受关注的标签是递归自我改进(让模型参与自身训练与优化流程,由模型自己提出改进方案并验证效果)。[2]
腾讯官方披露,模型首次参与训练方法、数据策略、评估体系、底层算子的自动优化,自己提方案、跑实验、看结果再迭代。[2]
模型还自主分析推理系统瓶颈,端到端吞吐相较基线提升31.8%。[2]这是“AI帮AI变强”从科幻走向工程化的信号,腾讯谨慎地把它框定为早期阶段。
③
在腾讯内部组织的163名专家203个工程任务的盲测中,Hy4 preview均分2.99/4,略优于GLM 5.32.92)和Kimi K32.94)。[2]
12项benchmark全面超越Hy3:GPQA Diamond92.3、DeepSWE64.3、SWE Bench Pro65.7、Terminal-Bench 2.185.4(超Hy3的70.8达14.6分)。[2]
协议上,Hy4 preview采用Apache 2.0(一种允许自由使用、修改和商用的开源许可证,限制极少),权重托管在Hugging Face、GitHub、ModelScope、Gitcode四大平台。[1]
定价延续国产开源的“白菜路线”:输入每百万tokens6元、输出18元、缓存命中最低0.3元。[2]WorkBuddy/CodeBuddy面向用户开展为期2周的限时免费活动。
④
从行业视角看,Hy4 preview不是孤例。[2]8月下旬国产开源模型集中开火:智谱GLM-5.3-Flash、阿里Qwen3.8-Flash-Next先后开源。
腾讯以770B旗舰入场,把国产开源推到OpenRouter前五的位置。[2]
腾讯的差异化在于“为生产力而生”,主打软件工程、办公分析、游戏开发、科学研究。[2]官方也坦诚局限,模型处理复杂问题时可能耗时过长、可能过度验证自己的答案
希望对大家了解国产开源大模型格局有所帮助,欢迎在评论区分享你对Hy4 preview的实际体验与看法。
参考来源:
[1] 腾讯混元 GitHub 仓库https://github.com/Tencent-Hunyuan/Hy4-preview
[2] 腾讯官方公告:Hy4 preview 发布并开源https://www.tencent.com/zh-cn/tencent-releases-and-open-sources-tencent-hy4-preview/
欢迎分享、点赞、推荐
一起拥抱AI
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.