时间:2026年8月25日
地点:浙江杭州(阿里千问)
人物:阿里巴巴通义千问(Qwen)团队
事件详情:
阿里千问 8 月 25 日通过魔搭社区(ModelScope)预告:北京时间 8 月 26 日 23:00 将开源 Qwen3.8-Flash-Next 模型,并同时发布 Qwen3.8-Flash-Next-FP8 量化版本。
据介绍,Qwen3.8-Flash-Next 是基于下一代 Qwen4 架构所构建的多模态 MoE 模型;官方称此次提前释出这些架构层面的改进,目的是让社区开发者提前为即将推出的完整 Qwen4 模型家族做好准备。
模型权重与推理代码将同时托管于 ModelScope 与 Hugging Face 两个开源平台。Flash-Next 系列主打低延迟推理与端侧部署场景,FP8 版本进一步压缩显存占用,适配消费级显卡与边缘设备。详细技术报告预计同步上线。
背景:
Qwen3.8 系列自 8 月初陆续推出 Max、Plus、2.4T-A95B 等多个版本,在 Artificial Analysis、SuperCLUE 等多项基准上追平或超越 Claude Opus 4.1、GPT-5.6 等国际前沿模型。Flash-Next 系列此前已发布 32B、8B 等规格,主打端侧推理与高吞吐 API 服务;此次引入多模态能力并预热 Qwen4 架构,意味着千问团队将端侧与云端模型路线进一步融合。Hugging Face 联合创始人 Clem 在社交平台表示:"Qwen 系列已经成为开源大模型的事实标准。"
影响:
1. Qwen4 架构预热意味着阿里将向社区提前暴露下一代模型的关键设计思路,开源生态进一步提速;
2. 多模态 + FP8 + 端侧部署三件套,利好消费级显卡、AI PC、智能眼镜与机器人等边缘 AI 场景;
3. 拉大与国内其他开源大模型(DeepSeek、Kimi、智谱)的代际差距,全球开源大模型竞争白热化。
总结:
阿里千问 8 月 26 日 23:00 将开源 Qwen3.8-Flash-Next 及 FP8 版本,基于下一代 Qwen4 架构的多模态 MoE 模型提前与社区见面。此举既是 Qwen4 系列全面开源的预热,也是阿里继续领跑全球开源大模型生态的关键落子。
参考来源:
1. https://www.ithome.com/0/994/252.htm
2. https://www.modelscope.cn/models/Qwen/Qwen3.8-Flash-Next
3. https://qwen.readthedocs.io/en/latest/
4. https://huggingface.co/Qwen
5. https://qwenlm.github.io/blog/
## 参考来源
- https://www.ithome.com/0/994/252.htm
- https://www.modelscope.cn/models/Qwen/Qwen3.8-Flash-Next
- https://qwen.readthedocs.io/en/latest/
- https://huggingface.co/Qwen
- https://qwenlm.github.io/blog/









