2026年9月国内主流AI助手更新了什么?豆包/DeepSeek/千问/Kimi/智谱逐家拆解

2026 年 9 月,豆包、DeepSeek、千问、Kimi、智谱五家都有实质更新。本文只讲对用户有实际影响的变化:谁把能力下放到了基础价位、谁真的降了成本、谁在提价换速度,并给出各自的核对方法。

相关 AI 产品

产品

豆包大模型 1.8

豆包大模型1.8正式发布:日均调用量超50万亿,多模态能力领跑AI行业 1 豆包大模型1.8是什么? 豆包大模型(Doubao Large Model)是字节跳动旗下火山引擎推出的自研大语言模型,最初名为“云雀”。 在2025年12月18日……

查看 ↗
产品

火山引擎豆包大模型

一、豆包大模型怎么用?免费在线访问获取API与完整使用教程 豆包大模型是字节跳动旗下火山引擎推出的综合性AI助手,自2024年推出以来迅速成长为国内用户规模最大的AI应用。根据QuestMobile最新数据,截至2025年12月,豆包月活跃……

查看 ↗
产品

豆包编程模型Doubao-Seed-Code

豆包编程模型Doubao-Seed-Code:专为Agentic编程任务优化的AI助手 1 豆包编程模型是什么? 豆包编程模型(Doubao-Seed-Code)是字节跳动旗下火山引擎于2025年11月11日正式发布的专业AI编程助手。这是……

查看 ↗
产品

通义千问

一、通义千问是什么?阿里云打造的AI助手全方位解析 通义千问是阿里云自主研发的通用人工智能大模型,其前身为2023年4月启动邀请测试的"通义千问",于同年9月备案后向公众开放。2024年5月,该产品正式更名为"通义",名称源自《汉书》"天地……

查看 ↗
产品

TRAE编程

1 TRAE是什么? TRAE是由字节跳动在2025年1月推出的AI原生集成开发环境(AI IDE),全称为“The Real AI Engineer”(真正的AI工程师)。作为国内首个AI原生IDE工具,TRAE旨在重新定义开发者与编程工……

查看 ↗
产品

TRAE Work

🧭 TRAE Work 实测 — 从 SOLO 升级而来的 AI 原生工作台,免费能打吗?(三段式) TRAE Work – 字节AI工作台,免费AI原生 IDE,SOLO自动写代码 TRAE Work 核心功能快览 TRAE Work 由……

查看 ↗

相关话题

「某某更新了什么」是个看起来很简单、实际很难查的问题。产品官网通常只挂一句「本次更新优化了体验」,真正的变化藏在版本号里、藏在计费页里、藏在某个功能悄悄挪了位置之后。这一篇把 2026 年 9 月国内五家主流 AI 助手(豆包、DeepSeek千问Kimi、智谱)的更新按「对用户的实际影响」重新排了一遍,只讲你真正会碰到的事。

Kimi:1M 上下文不再是高价位专属

9 月 13 日,月之暗面全量上线 K2.8 Preview,同时覆盖 Kimi Code 与 Kimi Work 两条产品线。

这次最值得注意的不是「性能接近 K3」这句宣传,而是两件事被下放到了基础会员

  • 上下文窗口从上一代 K2.7 Code 的 256K 扩到 1M token
  • 支持与 K3 一致的思考强度调节

为什么这重要:此前 K3 要 99 元档才起用,而 1M 上下文更是 199 元以上档位才有的能力。也就是说,百万级上下文的使用门槛被打掉了。处理长文档、长代码库、多轮 Agent 任务的成本会明显下降。新模型还补上了图像输入。

另外 9 月 17 日 Kimi Code 桌面版发布,内置 K3 并支持接入第三方模型。

豆包:2.1 Pro 升到 0915 版,重点在 Agent 与多模态 Coding

9 月 16 日,火山引擎宣布豆包大模型 2.1 Pro 升级至 0915 版,API 已全量上线火山方舟,TRAE 同步接入。四个方向:Agent 任务交付、多模态 Coding、多模态理解、Token 效率。

有两个数字值得记:

  • Coding 维度:对开源游戏 Luanti(约 38.7 万行代码)做自主修复测试,1000 个真实 Issue 中 83% 修复到可合并标准
  • Image/Video 推理的 Token 消耗比上一代减少 30% 以上——对按量计费的用户是直接降价

企业侧不用换 API 节点即可升级,这是字节在企业级市场上比较典型的一步。

豆包这个月还有两件事:9 月 14 日深夜发布豆包手机助手消费者版(支持语音/AI 键唤醒、跨 App 下单叫车,并推出 SAEP 屏幕自动化操作声明协议);9 月 15 日飞书 8.0 首发「豆包工作伙伴」团队智能体。9 月 17 日特斯拉 OTA 也扩大了豆包语音助手覆盖范围。

千问:Omni-Flash 把音视频 API 打到 98% 降幅

9 月 18 日,阿里上线全模态 Qwen Omni-Flash,音视频相关 API 价格降幅达 98%。同一天达摩院医疗影像 AI「DAMO RADAR」登上 Science。

如果你在做多模态应用,这是本月最该去核对的一件事——但也提醒一句:降价公告里的百分比,通常对应的是特定档位或特定调用方式,务必按你自己的实际调用结构去算一遍,别按宣传口径估算成本。

DeepSeek:V4.1 Flash 推倒重来,App 开始灰测语音

9 月 14 日,DeepSeek V4.1 Flash 发布,官方口径是「推倒重来」,为 Agent 场景重建了架构。

9 月 12 日,DeepSeek App 开始灰测语音对话,一次上了四种音色。9 月 19 日还推出了节假日空闲时段 API 费用减半。

智谱:GLM-5.3-FlashX 提价但提速,GLM-6.0 路线公开

9 月 18 日,GLM-5.3-FlashX 上线,推理速度提升约 5 倍(官方称达 200 tokens/s),但价格是上调的。这是个少见的方向:别人在降价,智谱在「提价换速度」,是否划算完全取决于你的场景对延迟有多敏感。

9 月 13 日智谱披露 GLM-6.0 完全自训练路线,9 月 17 日又公开了国内首个 RSI(递归自我改进)实践,用 10 万张国产卡「用 GLM 造 GLM」。

这份「更新记录」帮你省掉什么

把上面几条并起来看,9 月国内大模型有两条主线:

  1. 能力下放而非能力上限之争——Kimi 把 1M 上下文下放到基础会员,豆包把多模态 Token 成本降 30%,千问把音视频 API 降 98%。对普通用户的含义是同样的钱能做的事变多了
  2. Agent 从演示走向交付——豆包演示 500+ 子 Agent 协作完成金融研报核验,智谱讲 RSI 自迭代,DeepSeek 为 Agent 重建架构。这些离日常使用还有距离,但方向已经明确。

怎么持续跟这些更新

产品官网的「更新日志」普遍写得很粗,想持续跟,建议两条路并行:一是看本站的AI 快讯时间线,它按天记录并标注了参考来源;二是直接盯计费页与模型列表页,价格和可用模型的变化往往比更新日志更早暴露真实变化

常见问题

Q:K2.8 Preview 和 K3 该选哪个?
K2.8 Preview 的定位是「综合性能接近 K3、thinking 效率更高」,且 1M 上下文已下放到基础会员。除非你有明确的 K3 专属能力需求,否则先用 K2.8 Preview 更划算。

Q:豆包 2.1 Pro 的 0915 版要重新接入吗?
不需要。API 已全量上线火山方舟,企业侧不换节点即可升级。

Q:GLM-5.3-FlashX 提价了还值得用吗?
看场景。它换的是速度(约 5 倍、200 tokens/s)。对延迟敏感、调用频繁的在线场景可能更划算;离线批量任务就没必要为速度付费。

Q:这些降价百分比能直接按比例算我的账单吗?
不能。降价通常只覆盖特定档位或特定调用类型,请按自己的实际调用结构核算。

参考来源

本文的事实均来自下列公开来源,其中站内快讯条目在正文里标注了原始出处(量子位、凤凰科技、IT之家、新浪财经等)。来源链接在发布前已逐个访问校验;搜索需求类证据取自百度与必应的公开下拉词接口,取证日期为 2026 年 9 月 20 日。

说明:下拉词与热搜接口不提供历史日期,只能反映取证当日的搜索意图,不代表长期趋势;本站对时效性有要求的结论均已标注具体日期。

本站快讯与产品页(事实出处)

厂商官方站点

站内相关产品与标签

搜索需求证据(百度 / 必应下拉词)

内容由 AI 生成,产品信息请以官网为准。