时间:2026年8月28日(腾讯混元发布并开源Hy4 preview,WorkBuddy/CodeBuddy/元宝/ima同步首发)
地点:深圳(腾讯总部)/ 同步通过腾讯云TokenHub及OpenRouter开放API
人物:腾讯首席AI科学家姚顺雨(混元大模型负责人)、混元研发团队
事件详情:8月28日,腾讯混元正式发布并开源新一代旗舰大语言模型Hy4 preview。该模型采用MoE(混合专家)架构,总参数达770B、单次推理激活49B,配套MTP投机解码层(10B总参/0.7B激活),上下文长度从Hy3的256K一举扩展至1M tokens,词表12万。架构细节方面,Hy4 preview共78层Transformer,其中第1层为dense FFN,其余77层为MoE,每层256个路由专家加1个共享专家,每个token激活top-8路由+1个共享,使用Gated DSA + IndexCache跨层稀疏索引。模型权重与训练代码以Apache 2.0许可证开源,推理API定价为输入6元/百万tokens、输出18元/百万tokens、缓存命中0.3元/百万tokens。
背景:Hy4 preview是腾讯混元在2026年2月重建预训练与强化学习基础设施后的第四代大模型,平均每两个月迭代一个大版本。姚顺雨主导的混元团队本次共披露12项benchmark成绩,覆盖Terminal Bench 2.1、DeepSWE、ProgramBench、SWE Atlas Refactoring、ALE-CLI、Toolathlon-Verified、APEX-Agents(pass@1)、PostTrainBench、OneMillionBench(with tools)、BioMysteryBench、Humanity's Last Exam(text-only)、HorizonMath(pass@4)等编程与Agent评测。Hy4 preview首度参与自身训练方法、数据策略、评估体系与底层算子的自动优化,端到端推理吞吐较基线提升31.8%。
影响:在腾讯内部组织的163名内部专家、203个工程任务盲测中,Hy4 preview均分2.99/4,略优于GLM 5.3(2.92/4.00)与Kimi K3(2.94/4.00)。在Code Arena WebDev编程榜单上,Hy4 preview高居第5名,开源模型中位列第3,仅次于DeepSeek V4系列与Qwen3.8-Max。Hy4 preview定价显著低于高峰时段的DeepSeek V4 Pro,WorkBuddy与CodeBuddy为开发者提供两周免费体验。新模型定位"为生产力而生",重点打磨软件工程、办公分析、游戏开发与科学研究的真实场景,标志着腾讯在开源大模型领域与字节、阿里、智谱形成新一轮正面竞争。
总结:腾讯混元以Hy4 preview重返开源大模型第一梯队,770B/49B的MoE规模与1M上下文长度配合激进定价,将进一步压缩开源模型的价格与性能边界,加速国产大模型在企业级Agent场景的渗透。
参考来源:
- https://cloud.tencent.com/developer/article/2733836
- https://www.toutiao.com/article/7679078034795676195/
- https://lij@stcn.com/article/detail/4149913.html
- https://cloud.tencent.com/developer/news/4518192
- http://www.geekpark.net/news/369549
- https://weibo.com/7209515062/5336894215030480









