时间:2026 年 8 月 13 日(北京时间)
地点:中国杭州(阿里巴巴全球总部)
人物:阿里千问 Qwen 团队
【事件详情】
8 月 13 日,阿里千问 Qwen 团队正式在魔搭社区(ModelScope)和 Hugging Face 开源 Qwen3.8-2.4T-A95B 大模型权重,总参数 2.4 万亿、每个 Token 激活 950 亿参数,原生支持 262144 Token 上下文、可扩展至 101 万 Token,采用 MoE 稀疏架构(每层 512 个专家、每 Token 路由 10 个专家 + 1 个共享专家)。
这是阿里千问首次将 Max 级别旗舰模型的权重对外开放。模型可通过 SGLang、vLLM 与 TokenSpeed 三大推理引擎部署,默认以思考模式运行。开源后,开源 AI 项目团队 Unsloth AI 利用动态 1-bit 分层选择性量化技术,将模型原始 4.9TB 体积压缩至 397GB,存储空间缩减 91%,410GB 内存 + 显存即可在本地运行。
基准测试方面,Qwen3.8-Max 在 PaperBench 中取得 93.0 分,超过 GPT-5.6 Sol、Fable 5 与 Claude Opus 4.8;在 OSWorld-Verified 中以 86.1 分位列参评模型第一;在参数化 CAD 基准中以 91.5 分超过 Fable 5、GPT-5.6 Sol 与 Gemini 3.1 Pro。
API 价格方面,Qwen3.8-Max 国内每百万 Tokens 输入 12 元、输出 36 元,隐式缓存命中 1.5 元;海外每百万 Tokens 输入 2 美元、输出 6 美元,隐式缓存命中 0.25 美元。
【背景】
7 月 19 日,阿里千问首次预告 Qwen3.8 大模型即将发布并开源,参数规模达 2.4T,并称性能仅次于 Fable 5。8 月 3 日,Qwen3.8-Max 正式发布,端到端编程、长程任务与多模态智能体能力显著提升,官方同步宣布将于一周内开源权重。8 月 12 日深夜,Qwen 团队通过魔搭社区公众号正式宣布开源。
Qwen3.8-2.4T-A95B 是基于 Qwen3.5 架构构建,重点优化编程、办公、科研工作与长周期智能体任务。其能力可让模型连续自主编程约 16 天、独立复现并改进一篇研究论文、参加真实算法竞赛,并在超过 2000 轮交互中经营一家虚拟电商企业。在 16 天自主编程任务中,Qwen3.8-Max 自主构建了自进化 Harness,并持续完成社区需求收集、issue 派发、代码生成、验证与自我修复。
【影响】
阿里千问首次将 Max 级别旗舰模型开源,是中国开源大模型布局的关键落子,标志中国头部大模型厂商在"开源最强大模型"赛道上与美国厂商正面竞争。
Unsloth AI 的 1-bit 量化压缩将 2.4 万亿参数模型体积压缩 91%,意味着顶尖大模型的本地化运行门槛大幅降低,可能推动开源大模型在边缘设备与个人开发者的普及。
Qwen 团队预告更小杯 Qwen3.8-27B 已在路上,未来阿里将形成"超大杯 + 大杯 + 中杯 + 小杯"完整开源模型矩阵。
【总结】
阿里千问此次开源 Qwen3.8-2.4T-A95B,是其首次将 Max 级旗舰大模型权重对外开放,标志中国大模型在参数规模、性能与开源生态三个维度上都进入全球第一梯队。配合 Unsloth 的极致量化压缩,2.4 万亿参数模型首次具备本地运行可行性,将进一步激活全球开发者社区参与中国大模型生态。
【参考来源】
- https://www.36kr.com/p/3937078710631810
- https://www.donews.com/news/detail/8/6668953.html
- https://i.ifeng.com/c/8vYNmKnFnwY
- https://tech.ifeng.com/c/8vWY82Q7HFs
- https://m.cnmo.com/news/814878.html
- https://finance.eastmoney.com/a/202607193811751985.html
- https://modelscope.cn/models/Qwen/Qwen3.8-2.4T-A95B
- https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B









