时间:2026年8月26日晚
地点:北京
人物:智谱AI(Z.ai)
事件详情:
智谱AI正式上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,总参数量320B,激活参数仅18B。在Artificial Analysis Intelligence Index中取得57分,与Anthropic Claude Opus 4.8得分持平;编程与Agent评测上接近Opus 4.8。定价为GLM-5.3的1/10,限时折扣内为1/20,仅为Claude Opus 4.8的1/40。模型权重采用MIT许可,已上线Hugging Face。
背景:
发布前,智谱以匿名模型Ox-Alpha(中文社区称牛来)在OpenCode和OpenRouter上进行大规模测试,6天处理超过20万亿Token,刷新双平台调用量纪录,测试流量全部由国产芯片提供算力支持。架构方面,GLM-5.3-Flash是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,相较GLM-5.3注意力计算量降低3.01倍、KV缓存降低4.44倍;激活参数32B降至18B、层数92降至45层近乎减半;用30T Token多模态语料预训练。
影响:
- 定价降至Opus 4.8的1/40,国产前沿模型首次在性能对齐Claude的同时实现极致性价比
- 320B总参/18B激活的MoE架构搭配稀疏-线性混合注意力,重新定义开源前沿模型效率基线
- 多模态能力原生集成视觉编码,可应用于前端开发、游戏开发、3D仿真等专业场景
- 大规模流量首次跑在国产芯片集群之上,硬件效率与单Token成本已达主流英伟达GPU相当水平
- OpenRouter、OpenCode等海外平台Ox-Alpha测试期间调用量创新高,国产模型在开发者生态形成真实渗透
总结:
智谱GLM-5.3-Flash用320B总参数/18B激活的稀疏-线性混合MoE架构,把与Claude Opus 4.8打平的智能水平拉到1/40的价格,且全栈跑在国产芯片之上。这是国产开源前沿模型第一次在性能、价格、底层算力三个维度同时对齐甚至超越海外闭源旗舰;与DeepSeek-V4-Flash、Kimi-K3形成中国开源模型三剑客,全球大模型竞争格局正在被重写。
参考来源:
https://www.ithome.com/0/994/765.htm
https://new.qq.com/rain/a/20260826A0DUX000
https://so.html5.qq.com/page/real/search_news?docid=70000021_8886a8ef9a553952
https://news.marsbit.co/flash/20260826221541628704.html
https://m.10jqka.com.cn/20260826/c679320048.shtml
https://new.qq.com/rain/a/20260826A0DPLW00
https://z.ai/blog/glm-5.3-flash









