时间:2026年7月31日
地点:杭州/中国
人物:DeepSeek 团队、梁文锋、超聚变 AI Lab
事件详情:DeepSeek 于7月31日正式上线 DeepSeek-V4-Flash-0731 正式版 API 同步开启公测,权重同步在 Hugging Face 开源。这是 V4-Flash 在保持 284B 参数 MoE 架构不变的前提下完成的一次重磅后训练升级,重点强化 Coding Agent、工具调用与复杂任务执行能力。基准测试显示,V4-Flash 正式版在 Terminal Bench 2.1 拿到 82.7、CyberGym 76.7、Toolathlon-Verified 70.3,Agent 终极测试 25.2 分已逼近 Opus-4.8 的 25.7 分,远超 V4-Pro 预览版 15.8 分。价格方面,V4-Flash 输入缓存命中 0.0028 美元/百万 token、缓存未命中 0.14 美元、输出 0.28 美元,并发上限 2500,仅为 V4-Pro 输出定价三分之一。
背景:DeepSeek V4 系列采用 284B 总参数 MoE、每 token 激活 13B、1M token 上下文设计,配合 DSpark 投机解码模块显著提升推理速度。V4-Flash 的 Responses API 与 Codex 适配能力使其成为种子轮企业、独立开发者和内部平台团队部署 agent 闭环的高性价比首选。MIT 协议不设门槛的开源权重也允许企业自建私有集群。8月1日,超聚变宣布 DeepSeek-V4-Flash-0731 已正式登陆超聚变 AI Lab 平台,可通过 PC 端在线体验。
影响:
- 以 V4-Pro 三分之一价格逼近 Opus-4.8 智能体能力,重塑企业级 agent 部署成本曲线
- DSpark 投机解码与 MIT 开源双管齐下,加速国产大模型在 to B 与自托管市场渗透
- Responses API 与 Codex 原生适配,降低智能体闭环工程门槛,吸引独立开发者与种子轮团队
总结:DeepSeek V4-Flash 正式版公测,是 2026 年下半年中国大模型最具代表性的"后训练跃迁"案例。架构不变、训练优化把智能体能力拉到接近 Opus-4.8 区间,价格却保持 V4-Flash 的中端定位。这一组合拳既稳固 DeepSeek 在智能体方向的成本优势,也为国产大模型在企业级 agent 市场的普及按下了加速键。
参考来源:
- https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731
- https://www.marktechpost.com/2026/07/31/deepseek-upgrades-deepseek-v4-flash-0731-with-major-agentic-and-coding-gains/
- https://api-docs.deepseek.com/quick_start/pricing
- https://news.qq.com/rain/a/20260801A0B6PM00
- https://tech.ifeng.com/c/8vF2prGVvYP
- https://m.163.com/dy/article/L39DVPAD0512B07B.html
- https://news.ifeng.com/c/8vF7rNh325v
- https://www.jiemian.com/article/14861607.html
- https://finance.jrj.com.cn/2026/08/01155057984936.shtml