DeepSeek V4 Flash 0731正式版 反超

时间:2026年7月31日 地点:北京(深度求索总部)/ 美国旧金山(Hugging Face 平台) 人物:深度求索DeepSeek团队;Hugging Face开源社区 事件详情: 深度求索7月31日正式发布DeepSeek-V4-Flash-0731,把模型从预览版升级为官方版本并同步上线公开Beta API,同日把MIT许可的开放权重推上Hugging Face。模型架构沿用之前的284B总参数、13B激活参数MoE,并集成DSpark推测解码模块,附加原生Responses API与Codex适配。本次升级仅重新做后训练,重点强化Agent能力。九项Agent基准测试上,V4-Flash-0731全面超越自家V4-Pro预览版,Cybergym从38.7跳至76.7,DeepSWE从7.3跃至54.4,Toolathlon-Verified从49.7升至70.3,差距从8.7到41.6分不等,并在Terminal Bench 2.1与Cybergym上贴近Anthropic Opus-4.8水平。 背景: DeepSeek在V4产品线采用了Flash主打Agent性价比、Pro主打顶尖推理的双轨策略。预览版的Flash和Pro在Agent能力上几乎打平,让Pro的旗舰定位一度尴尬。这次0731版通过后训练把Agent能力集中强化到一个284B/13B的稀疏MoE上,并维持100万token上下文、38.4万token最大输出,价格保持V4-Flash原有水平。MIT开源权重加上Cache Hit每百万token仅0.0028美元的极致定价,让它成为Agent场景下的高性价比新默认选项。 影响: - V4-Flash-0731用13B激活参数在Agent基准上击败49B激活的V4-Pro预览版,证明Agent能力更多由后训练策略而非参数总量决定。 - MIT开源权重、推测解码和极致Cache定价,让中小团队和个人开发者也能本地或API侧部署接近Opus水平的Agent模型。 - 深度求索把Pro预览版的Agent王座让位给Flash,意味着Pro的官方版本必须拿出更强的推理或长上下文能力才能拉开差距。 - 行业层面,Agent评测榜单出现新搅局者,OpenAI、Anthropic、智谱、月之暗面等需要重新评估开源模型在企业Agent工作流中的角色。 - 价格与许可证组合继续压低Agent基础设施门槛,可能推动SaaS厂商加速用DeepSeek替代闭源模型以控制成本。 总结: DeepSeek-V4-Flash-0731是一次用后训练而非扩参提升Agent能力的典型案例,13B激活的稀疏MoE在九项Agent基准上反超自家49B的Pro预览,并在Toolathlon-Verified、Cybergym等关键测试中逼近Anthropic Opus-4.8。MIT许可的开放权重、Cache Hit每百万0.0028美元的定价与DSpark推测解码共同把Agent模型推向低成本时代。V4-Pro的正式版预计8月推出Responses API与Codex适配,能否夺回Agent榜首将成为下一阶段观察重点。 参考来源: - https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731 - https://huggingface.co/blog/ResterChed/deepseek-v4-flash-official-release - https://api-docs.deepseek.com/quick_start/pricing/ - https://openrouter.ai/deepseek/deepseek-v4-flash-0731 - https://lmstudio.ai/models/deepseek-v4-flash - https://news.ycombinator.com/item?id=49120299 - https://www.marktechpost.com/2026/07/31/deepseek-upgrades-deepseek-v4-flash-0731-with-major-agentic-and-coding-gains/amp/ - https://recipes.vllm.ai/deepseek-ai/DeepSeek-V4-Flash - https://arcprize.org/results/deepseek-v4-flash-0731 - https://x.com/deepseek_ai