时间:2026年9月9日
地点:中国,北京
人物:DeepSeek官方运营团队、模型API定价负责人
事件详情:2026年9月9日,DeepSeek在官方开放平台发布公告,宣布将于北京时间2026年9月10日12:00起调整Flash系列模型定价。本次调整覆盖deepseek-v4-flash和deepseek-v4-flash-vision-exp两款模型。
调整后空闲时段(其余时段)定价为:输入缓存命中单价0.02元/百万Tokens,输入缓存未命中单价1元/百万Tokens,输出单价4元/百万Tokens;高峰时段(北京时间周一至周五9:00-12:00、14:00-18:00)价格仍为空闲时段的两倍,即缓存命中0.04元、未命中2元、输出8元。
具体降幅方面:缓存命中输入价格由0.05元降至0.02元(降60%),缓存未命中输入由1.5元降至1元(降33.33%),输出由4.5元降至4元(降11.11%)。对比8月17日涨价前的Flash系列统一价(0.02元/1元/2元),本次调价后输入侧两项价格已回到涨价前水平,但输出价格仍为涨价前(2元)的两倍。
背景:此次降价距8月13日DeepSeek V4 Pro正式版上线引发的涨价潮不到一个月。当时V4 Pro系列最高涨幅达到11倍,开发者社区对涨价反应强烈,认为涨价削弱了DeepSeek的性价比优势。8月17日DeepSeek完成V4系列峰谷定价调整,8月23日又优化峰谷计费规则,周六、周日全天不再区分峰谷统一执行低谷价。
市场分析认为,Flash系列本定位于"靠低价抢量",8月涨价后流量被中转平台和竞品(如智谱GLM)分流,企业用户更看重性价比而非品牌忠诚度。同期DeepSeek正在内测V4.1 Flash新模型(模型名deepseek-v4.1-flash-expires-on-0910),9月10日期满自动下线,新模型采用新架构原生支持多模态。
影响:本次Flash系列降价将显著降低高频调用、长上下文、固定系统提示词、Agent循环调用等缓存命中率较高场景的调用成本。结合9月8日开启内测的V4.1 Flash新模型,DeepSeek在保持速度与成本竞争力的同时推进多模态能力,有望在中端API市场重新夺回被智谱GLM、千问等竞品分流的份额。
总结:DeepSeek本次Flash系列降价是8月涨价后的战术修正,输入侧价格基本回到涨价前,输出价格仍维持涨价后的水平。本次调价反映了中国大模型API市场竞争进入新一轮价格博弈期——OpenAI GPT-6 Astra定位高端、智谱GLM走本地化部署路线,DeepSeek Flash则继续在低价高速细分市场卡位。同步内测的V4.1 Flash多模态版本将成为观察DeepSeek下一代定价策略的关键窗口。
参考来源:
1. 新浪财经:https://finance.sina.com.cn/jjxw/2026-09-09/doc-iniresye8845429.shtml
2. IT之家:https://www.ithome.com/0/999/953.htm
3. 36氪:https://www.36kr.com/p/3975652260622596
4. 界面新闻:https://www.jiemian.com/article/15072966.html
5. 搜狐(快科技):https://m.sohu.com/a/1073606108_122066679
6. 腾讯新闻(观察者网):https://new.qq.com/rain/a/20260909A05GM300
7. 腾讯新闻(快科技):https://new.qq.com/rain/a/20260909A056J200
8. 新浪财经(每日经济新闻):https://finance.sina.cn/2026-09-09/detail-iniresxy8938890.d.html









