**时间:** 2026年8月26日晚
**地点:** 北京
**人物:** 智谱AI 团队
**事件详情:**
8月26日晚,智谱AI正式上线并开源 GLM-5.3-Flash (320B-A18B),这是 GLM-5 系列首个原生多模态模型。该模型总参数 320B、激活 18B,首次采用稀疏注意力与线性注意力混合架构,综合能力超过上一代 GLM-5.2。在 Artificial Analysis Intelligence Index(AA 综合智能指数)测评中,GLM-5.3-Flash 取得 57 分,进入全球前沿模型能力区间,与 Anthropic 旗下最受欢迎的 Claude Opus 4.8 得分持平,编程能力同样对标。价格方面,新模型定价仅前代 GLM-5.3 的 1/10,相对 Opus 4.8 砍至 1/40。发布前夕,模型以匿名身份"OX Alpha"(中文圈昵称"牛来")登录 OpenRouter 与 OpenCode 平台,凭借 100 万 token 上下文、多模态、完全免费的表现,直接登顶两大平台榜首。
**背景:**
智谱 GLM 系列长期被定位为对标国际前沿闭源模型的开源路线代表。GLM-5.2 在推理与代码任务上已具备国际可比能力,但商用推理成本偏高、激活参数规模较大,限制了在前端应用侧的渗透。此次 GLM-5.3-Flash 把激活参数从 32B 量级砍至 18B,配合稀疏/线性注意力混合架构,是智谱首次将"前沿模型能力"与"Flash 级推理成本"明确合体的尝试——这一产品定位与 Mistral 早期"Flash"系列、Google Gemini Flash 系列、阿里 Qwen Flash 系列一脉相承,背后是国内大模型厂商集体向"性能可商用、成本可负担"区间下沉的清晰信号。值得注意的是,模型开源当日即完成国产算力全栈适配:壁仞科技基于 SGLang 框架在壁砺 166M 完成推理验证、昆仑芯宣布首批完成适配并联合精调、百度智能云同步实现全栈适配支持,构建出"模型开源-国产芯片-国产云"三日内同步落地的协同节奏。
**影响:**
从开发者侧看,GLM-5.3-Flash 把"对标 Opus 4.8 的能力 + 1/40 价格"摆到桌面,等同把原本只有闭源大厂能用得起的前沿模型直接变成消费级 API 价格,国内 AI 应用开发者构建复杂多模态 agent、代码助手、视频理解系统的边际成本大幅下移。从生态侧看,国产芯片厂商在 24 小时内集体完成适配,意味着 GLM-5.3-Flash 已成为继 DeepSeek、Qwen 之后,又一个可立刻在国产算力栈上跑起来的前沿开源模型,对降低国内 AI 推理对英伟达 GPU 的依赖具有可观测的边际贡献。从竞争侧看,Anthropic、Google、OpenAI 等闭源厂商面对"开源 18B 激活追平自家 4.8 旗舰 + 40 倍价格优势"的组合,必须在产品分层、定价策略、企业级私有化部署上重新设计差异化护城河——这与今年 5 月 DeepSeek R1 引发的那一轮"开源冲击"逻辑高度一致。
**总结:**
智谱此次开源不仅补齐了 GLM-5 系列的原生多模态短板,更把"前沿能力 + Flash 价格 + 国产算力全栈适配"作为组合拳一次性打出,是 2026 年下半年中国开源大模型在"性能-成本-生态"三轴上的又一次集中跃迁。对于希望降低闭源依赖、又不愿牺牲前沿能力的国内企业,GLM-5.3-Flash 已经成为绕不开的对比基线。
**参考来源:**
1. 腾讯新闻(IT时代网):《智谱开源GLM-5.3-Flash大模型,定价仅前代十分之一》— https://news.qq.com/rain/a/20260826A0DPLW00
2. 智谱AI开放文档:《GLM-5.3-Flash》— https://docs.bigmodel.cn/cn/guide/models/vlm/glm-5.3-flash
3. AIBase(中文):《价格砍至四十分之一!智谱开源原生多模态大模型GLM-5.3-Flash》— https://news.aibase.com/zh/news/30655
4. AIBase (English):《Price Cut to 1/40! Zhipu Opensources Native Multimodal Large Model GLM-5.3-Flash》— https://www.aibase.com/news/30655
5. Emergent.sh:《Zhipu AI Launches GLM-5.3-Flash: Fast Multimodal Model》— https://emergent.sh/news/glm-5-3-flash-officially-launched
6. AI Market Watch:《Zhipu releases GLM-5.3-Flash with SenseTime-backed domestic inference》— https://www.ai-market-watch.com/news/zhipu-releases-and-open-sources-the-320b-parameter-glm-53-flash-with-sensetime-i-slfto6
7. Cocoloop:《Zhipu Open-Sources GLM-5.3-Flash, Cuts Active Params to 18B》— https://news.cocoloop.cn/2026/08/glm-53-flash-320b-mit-open
8. 少数派:《派早报:智谱开源 GLM-5.3-Flash 原生多模态模型等》— https://sspai.com/post/113922
9. 果壳网:《Google发布Gemini Omni 1.1 Flash视频生成模型;阿里通义发布Qwen3.8-Flash;智谱开源 GLM-5.3-Flash》— https://www.guokr.com/article/470063/









