DeepSeek V4-Flash正式版 API公测上线

时间:2026年7月31日 地点:中国杭州 人物:DeepSeek(深度求索)官方团队 事件详情:DeepSeek 于 2026 年 7 月 31 日通过 API 文档发布日志,正式上线 DeepSeek-V4-Flash 正式版(GA)API 公测。本次仅升级 V4-Flash 的 API 接口,APP 与 Web 端模型未做调整,V4-Pro API 同样保持原状,官方表示 V4-Pro 正式版将尽快发布。V4-Flash-0731 在模型结构、参数规模上与 Preview 版完全一致,仅在后训练阶段做了重训,重点针对 Agent 与代码场景做适配优化。正式版原生支持 Responses API 格式,并对 OpenAI Codex 做了针对性适配,可在 Codex 客户端中通过 DeepSeek API Key 直接调用 deepseek-v4-flash。 背景:DeepSeek V4 系列于 4 月底首次发布并开源两档模型,Pro 版 1.6T 总参 49B 激活、Flash 版 284B 总参 13B 激活,两档均支持 1M token 超长上下文与 MIT 开源协议。V4-Flash 自 Preview 阶段起就主打性价比路线,输入定价 0.14 美元/百万 token,缓存命中仅 0.028 美元/百万 token,远低于主流闭源旗舰。此次 GA 版的发布正值 OpenAI GPT-5.6 系列大幅降价:Luna 输入价直降 80% 至 0.2 美元/百万 token,Terra 下调 20%,Codex 自动审批模式成本直降 10 倍;DeepSeek 用 GA 版正式回应这场价格战,保留 V4-Flash 在 Agent 与长上下文任务上的成本优势。 影响: - V4-Flash 9 项 Agent 基准测试结果全部超越自家 V4-Pro-Preview 版:Terminal Bench 2.1 拿下 82.7 分、NL2Repo 54.2、Cybergym 76.7、DeepSWE 54.4、Toolathlon verified 70.3、Agent Last Exam 25.2、Automation Bench 25.1、DSBench-FullStack 68.7、DSBench-Hard 59.6,刷新开源 Agent 模型第一梯队上限 - GA 版原生适配 Codex 与 Responses API,开发者可在 Codex CLI 中无缝切换到 DeepSeek-V4-Flash,进一步压缩企业 Agent 智能体的推理成本 - 与 GPT-5.6 Luna 形成正面价格对决:Luna 输入价 0.2 美元/百万 token 仍高于 V4-Pro 的 0.4 美元区间但差距大幅缩小,OpenAI 罕见地在执行高风险操作前先调用 Luna 跑一遍自动审批 总结:DeepSeek 用一场「不换参数、只换后训练」的轻量升级把 V4-Flash 推向 GA,以 0.14 美元/百万 token 的输入价 + 1M token 上下文 + MIT 开源 + 9 项 Agent 基准碾压自家 Preview 的成绩单,直接迎战 OpenAI 本周 GPT-5.6 系列最高 80% 的降价。V4-Pro 正式版尚未发布,但 Flash 的 GA 已经足以让 Codex 类 Agent 工具链开发者重新核算成本:开源高性价比模型与闭源旗舰的价格差距被进一步压缩,下一步市场关注点将转向 V4-Pro GA 的发布时点与 DeepSeek 在内蒙古乌兰察布的 1GW 数据中心建设进展。 参考来源: - https://m.ithome.com/html/984116.htm - https://api-docs.deepseek.com/zh-cn/quick_start/agent_integrations/codex - https://developer.nvidia.com/blog/build-with-deepseek-v4-using-nvidia-blackwell-and-gpu-accelerated-endpoints/ - https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash - https://news.qq.com/rain/a/20260731A03A8900 - https://news.qq.com/rain/a/20260731A02U2300 - https://www.opp2.com/380993.html