时间:2026 年 8 月 28 日(36 氪报道)
地点:北京(智谱 AI 总部)与中国 AI 大模型市场
人物:智谱 AI(推出 GLM-5.3-Flash 的国产大模型厂商);DeepSeek(被对标的"价格屠夫",刚于 8 月 17 日执行峰谷涨价);DeepSeek 创始人梁文锋("梁文峰""梁文谷"出处);麦肯锡、Hermes Agent 创始人、SemiAnalysis(提供横向参考的机构与评论方)
事件详情:智谱 AI 发布的 GLM-5.3-Flash 每百万 Token 输入 0.8 元、输出 2.8 元,并提供至 9 月 9 日的两周限时半价(输入 0.4 元、输出 1.4 元)。Artificial Analysis Intelligence Index 拿下 57 分,高于 DeepSeek V4 Pro 正式版 53 分,官方称部分口径对标 Claude Opus 4.8。在未命中缓存的输入/输出维度,GLM-5.3-Flash 比调价后的 DeepSeek V4 Flash 谷时还便宜;但在 Agent 场景最常用的"缓存命中输入"维度,其标准价 0.23 元/百万 Token 即使在半价期内也要 0.115 元,而 DeepSeek V4 Flash 峰时仅 0.014 美元(约 0.1 元)、谷时低至 0.05 元,缓存命中单项上 GLM-5.3-Flash 反而比 DeepSeek 谷时贵约 90%、峰时贵约 6%。36 氪按"50 万 Token 输入、99% 命中缓存、1 万 Token 输出"的 Agent 任务测算,优惠结束后 GLM-5.3-Flash 约 0.146 元,DeepSeek V4 Flash 谷时仅约 0.077 元,价差近 1 倍。
背景:智谱 GLM-5.3-Flash 即此前刷屏 OpenRouter 与 OpenCode 的匿名模型 Ox Alpha("牛来"),总参数 3200 亿、单 Token 激活 180 亿,是 GLM-5 系列首个原生多模态基座,采用稀疏注意力+线性注意力混合架构,推理跑在 10 万张国产芯片(疑来自华为昇腾、摩尔线程、海光)之上。同期 DeepSeek V4 Flash 自 8 月 17 日执行峰谷新价后,谷时输出仍为 4.5 元、峰时涨至 9 元,OpenCode 平台调用量直接腰斩;OpenRouter 上 DeepSeek 连续 56 天的调用量榜首随即被 Ox Alpha 终结。麦肯锡 2025 全球 AI 调查显示 62% 受访企业已在试验 Agent,但任何单一职能规模化采用比例仍不足 10%,定价正成为 Agent 普及的隐性杠杆。
影响:缓存命中是 Agent 反复调用模型时真实账单的大头(系统提示词、工具定义、长文档前缀可复用),价格屠夫对价格屠夫的"反向贵 90%"意味着智谱并不能在所有工作负载上全面取代 DeepSeek;同时智谱把 Llama 系、Qwen 系之外的国产 MoE+缓存架构拉到 320B/18B 量级,倒逼国产芯片在 10 万卡规模上完成"百万 Token 上下文+端到端 3 倍性能提升"的工程验证,CUDA 护城河再次被 SemiAnalysis 点名拷问。开发者侧的现实路径将走向"按场景混合路由"——高频高缓存命中任务仍倾向 DeepSeek 谷时;中低缓存命中、需要多模态或更长上下文时迁移到 GLM-5.3-Flash,享受半价红利;Kimi K3、Claude Opus 4.8 等高价模型仅用于最难的复杂推理。
总结:智谱用 GLM-5.3-Flash 在"性能—价格"曲线上画出了一道肉眼可见的新低,但 36 氪用一道 Agent 任务账单算给行业看——缓存命中单项上,国产新王依旧输给"梁文谷"。两款 Flash 模型各有最优工况,"半价 14 天+ 国产 10 万卡"只是这场对决的中场节点,下一轮战火会烧向 Agent 编排、混合路由与更激进的峰谷定价。
参考来源:
1. 36 氪:「牛到家」的智谱,第一刀就砍向 DeepSeek,https://www.36kr.com/p/3958937888609920
2. 钛媒体:GLM-5.3-Flash 发布,多模态终于来了,https://www.toutiao.com/article/7678506315974509098
3. 今日头条:价格打穿底线?国产三大 Flash 模型全方位横评,https://www.toutiao.com/a7678916583141442092
4. CSDN 技术博客:GLM-5.3-Flash 对比 DeepSeek:同样接近前沿的智能,谁更便宜?,https://blog.csdn.net/m0_37988015/article/details/164110111
5. 腾讯证券:智谱 GLM-5.3-Flash 发布 国产 AI 模型定价性能对比,https://gu.qq.com/resources/shy/news/detail-v2/index.html?_tentrees_trans=0&id=SN20260827101723a4c17af7
6. 微博 @Easy 同学正在独立开发:智谱 GLM-5.3-Flash 发布 国产 AI 模型定价性能对比,https://weibo.com/1088413295/5336294630626156
7. 微博 @量子位:智谱开源 GLM-5.3 Flash 剑指 DeepSeek 运行于 10 万张国产芯片,https://weibo.com/3208430071/5336557326447636
8. 晚点 LatePost(经腾讯证券转引):DeepSeek V4 Flash 涨价后 OpenCode 调用量下滑一半









