热门AI工具推荐

AI编程订阅服务,支持多款国产主流编程模型自由切换。
Seedance 2.0AI视频生成
具备卓越的物理真实性和角色一致性,可生成电影级视频内容。
方舟 Agent PlanAI智能体订阅
火山引擎推出的全场景AI智能体订阅服务,通过一个订阅整合5大主流模型和10+AI工具
StepClaw阶跃AI桌面伙伴龙虾Agent智能体
StepClaw是阶跃星辰推出的本地和云端的AI龙虾助手,通过一键部署让普通用户也能拥有7×24小时在线、可自主执行任务的AI数字工作伙伴。
基于OpenClaw架构打造的AI助手平台,核心优势包括云端一键部署、沙箱隔离安全运行、全面接入企业微信/钉钉/飞书三大主流IM工具
SpeedAIAI内容检测降重
AI内容检测与降重工具,能有效帮助用户通过论文AI率检测
墨刀AIAI原型设计平台
墨刀AI是一款能通过一句话描述或图片,快速生成可交互原型、PRD文档及各类图表的一站式智能产品设计协作平台。
秒哒AI工具
不懂代码也能开发应用?百度秒哒:无需编程,快速搭建小程序与网站
有戏AIAI漫剧生成工具
全流程AI短剧创作工具,实现从剧本到成片的自动化生产,让“一人即剧组”成为现实。
沁言学术智能科研平台
一站式文献管理与科研写作工具,支持边写作边搜索文献,高效阅读,文献管理,

智谱对砍DeepSeek 缓存命中贵九成

时间:2026 年 8 月 28 日(36 氪报道) 地点:北京(智谱 AI 总部)与中国 AI 大模型市场 人物:智谱 AI(推出 GLM-5.3-Flash 的国产大模型厂商);DeepSeek(被对标的"价格屠夫",刚于 8 月 17 日执行峰谷涨价);DeepSeek 创始人梁文锋("梁文峰""梁文谷"出处);麦肯锡、Hermes Agent 创始人、SemiAnalysis(提供横向参考的机构与评论方) 事件详情:智谱 AI 发布的 GLM-5.3-Flash 每百万 Token 输入 0.8 元、输出 2.8 元,并提供至 9 月 9 日的两周限时半价(输入 0.4 元、输出 1.4 元)。Artificial Analysis Intelligence Index 拿下 57 分,高于 DeepSeek V4 Pro 正式版 53 分,官方称部分口径对标 Claude Opus 4.8。在未命中缓存的输入/输出维度,GLM-5.3-Flash 比调价后的 DeepSeek V4 Flash 谷时还便宜;但在 Agent 场景最常用的"缓存命中输入"维度,其标准价 0.23 元/百万 Token 即使在半价期内也要 0.115 元,而 DeepSeek V4 Flash 峰时仅 0.014 美元(约 0.1 元)、谷时低至 0.05 元,缓存命中单项上 GLM-5.3-Flash 反而比 DeepSeek 谷时贵约 90%、峰时贵约 6%。36 氪按"50 万 Token 输入、99% 命中缓存、1 万 Token 输出"的 Agent 任务测算,优惠结束后 GLM-5.3-Flash 约 0.146 元,DeepSeek V4 Flash 谷时仅约 0.077 元,价差近 1 倍。 背景:智谱 GLM-5.3-Flash 即此前刷屏 OpenRouter 与 OpenCode 的匿名模型 Ox Alpha("牛来"),总参数 3200 亿、单 Token 激活 180 亿,是 GLM-5 系列首个原生多模态基座,采用稀疏注意力+线性注意力混合架构,推理跑在 10 万张国产芯片(疑来自华为昇腾、摩尔线程、海光)之上。同期 DeepSeek V4 Flash 自 8 月 17 日执行峰谷新价后,谷时输出仍为 4.5 元、峰时涨至 9 元,OpenCode 平台调用量直接腰斩;OpenRouter 上 DeepSeek 连续 56 天的调用量榜首随即被 Ox Alpha 终结。麦肯锡 2025 全球 AI 调查显示 62% 受访企业已在试验 Agent,但任何单一职能规模化采用比例仍不足 10%,定价正成为 Agent 普及的隐性杠杆。 影响:缓存命中是 Agent 反复调用模型时真实账单的大头(系统提示词、工具定义、长文档前缀可复用),价格屠夫对价格屠夫的"反向贵 90%"意味着智谱并不能在所有工作负载上全面取代 DeepSeek;同时智谱把 Llama 系、Qwen 系之外的国产 MoE+缓存架构拉到 320B/18B 量级,倒逼国产芯片在 10 万卡规模上完成"百万 Token 上下文+端到端 3 倍性能提升"的工程验证,CUDA 护城河再次被 SemiAnalysis 点名拷问。开发者侧的现实路径将走向"按场景混合路由"——高频高缓存命中任务仍倾向 DeepSeek 谷时;中低缓存命中、需要多模态或更长上下文时迁移到 GLM-5.3-Flash,享受半价红利;Kimi K3、Claude Opus 4.8 等高价模型仅用于最难的复杂推理。 总结:智谱用 GLM-5.3-Flash 在"性能—价格"曲线上画出了一道肉眼可见的新低,但 36 氪用一道 Agent 任务账单算给行业看——缓存命中单项上,国产新王依旧输给"梁文谷"。两款 Flash 模型各有最优工况,"半价 14 天+ 国产 10 万卡"只是这场对决的中场节点,下一轮战火会烧向 Agent 编排、混合路由与更激进的峰谷定价。 参考来源: 1. 36 氪:「牛到家」的智谱,第一刀就砍向 DeepSeek,https://www.36kr.com/p/3958937888609920 2. 钛媒体:GLM-5.3-Flash 发布,多模态终于来了,https://www.toutiao.com/article/7678506315974509098 3. 今日头条:价格打穿底线?国产三大 Flash 模型全方位横评,https://www.toutiao.com/a7678916583141442092 4. CSDN 技术博客:GLM-5.3-Flash 对比 DeepSeek:同样接近前沿的智能,谁更便宜?,https://blog.csdn.net/m0_37988015/article/details/164110111 5. 腾讯证券:智谱 GLM-5.3-Flash 发布 国产 AI 模型定价性能对比,https://gu.qq.com/resources/shy/news/detail-v2/index.html?_tentrees_trans=0&id=SN20260827101723a4c17af7 6. 微博 @Easy 同学正在独立开发:智谱 GLM-5.3-Flash 发布 国产 AI 模型定价性能对比,https://weibo.com/1088413295/5336294630626156 7. 微博 @量子位:智谱开源 GLM-5.3 Flash 剑指 DeepSeek 运行于 10 万张国产芯片,https://weibo.com/3208430071/5336557326447636 8. 晚点 LatePost(经腾讯证券转引):DeepSeek V4 Flash 涨价后 OpenCode 调用量下滑一半