时间:2026年9月10日
地点:北京
人物:DeepSeek(深度求索)
事件详情:9月10日,DeepSeek正式发布V4.1-Flash模型并同步上线API。V4.1-Flash为552B参数MoE混合专家架构,采用全新Causal-Encoder-Decoder非对称结构,输入激活仅8B、输出激活16B,运行成本显著低于同规格模型。模型具备原生多模态视觉理解能力,HBM显存需求降至上一代的1/4、SSD存储需求降至1/8。官方基准测试显示,V4.1-Flash在代码、工具调用、Agent等多项指标上已全面超越现役的V4 Pro。
背景:V4.1-Flash于9月8日开启中间版本内测,模型名deepseek-v4.1-flash-expires-on-0910,单账号限流20并发,计费沿用V4 Flash旧价。社区实测输出速度达每秒284-507个token,较V4系列约97个token提升2-5倍。同步生效的Flash系列新定价采用峰谷分时机制:闲时缓存命中0.02元/百万token(降60%)、缓存未命中1元(降33%)、输出4元(降11%),高峰时段价格翻倍。DeepSeek同步在V4.1-Flash内测问卷中询问"能否全面替代V4 Pro",定位信号明显。
影响:旧版V4 Flash与V4 Flash Vision Exp同步下线。9月14日12时起,V4.1 Pro正式发布前,所有指向V4 Pro的API请求将自动路由至V4.1-Flash并按Flash单价计费,实现"升级降价同步"。腾讯WorkBuddy、CodeBuddy、OpenCode已完成全量接入。V4.1-Flash让Flash级定价获得Pro级能力,进一步压缩国内大模型毛利空间,加剧行业洗牌。同日另有消息称DeepSeek已聘请中信证券筹备科创板IPO,计划年内正式启动。
总结:V4.1-Flash是DeepSeek"智能密度"战略的关键落子,用Flash的定价承载Pro的能力,把"快且便宜"推到Pro级,推动国内大模型竞争从参数比拼转向"单位成本下的能力密度"。
参考来源:
- https://x.com/deepseek_ai/status/2097930608790167907
- https://www.tmtpost.com/8134068.html
- https://new.qq.com/rain/a/20260910A07M0R00
- https://new.qq.com/rain/a/20260910A07VKN00
- https://news.qq.com/rain/a/20260909A0CWDE00
- https://www.frontiernews.ai/news/article/deepseeks-v41-flash-emerges-as-secret-beta-what-th-7922734f
- https://news.qq.com/rain/a/20260908A0CINL00
- https://www.163.com/dy/article/L6F7OIUK0556OXHR.html
- https://cloud.tencent.com/developer/article/2739871









