**时间:** 2026年10月5日(周一,Robert Lea 报告发布日)
**地点:** 美国 / 中国
**人物:** 彭博行业研究(Bloomberg Intelligence)高级分析师 Robert Lea;DeepSeek V4.1 Flash 开发团队
**事件详情:** 彭博行业研究(Bloomberg Intelligence)高级分析师 Robert Lea 于10月5日发布的报告显示,DeepSeek 9月发布 V4.1 Flash 后,中国顶尖 AI 模型在 LiveBench 基准测试上仅落后美国竞争对手 3%,差距从2026年初的约15%、5月的9%急剧收窄至历史最低。DeepSeek V4.1 Flash 在 LiveBench 全球排名第六,得分 81.1;Anthropic 顶级模型以 83.4 分领跑,V4.1 Flash 被认为「可与 Anthropic、OpenAI 的领先 AI 系统相媲美」,两者仅差 2.3 分。
**背景:** 中国 AI 模型崛起得益于专业能力深化与针对国产硬件的优化能力。LiveBench 通过问答、解谜与任务分析进行评分,类比于人类智商测试,是当前最被业内认可的「防刷题」基准之一。本次差距收窄距 DeepSeek 2025年凭 R1 模型引发英伟达单日市值蒸发约 5,890 亿美元(1月27日美股史上最大单日跌幅)已近两年。彭博指出,这些进展让外界对美国出口管制的有效性产生进一步质疑——制裁未能阻止中国在训练效率与推理性能上的快速逼近。
**详情:** LiveBench 前 15 名中仅 3 个来自中国,提示追赶仍处于「集中突破」阶段而非全面铺开:DeepSeek V4.1 Flash、阿里 Qwen 系列与月之暗面 Kimi K3 各占一席。报告同时强调,中国实验室更多聚焦特定基准的极致优化,而非像美国头部厂商那样构建覆盖文本/图像/视频/代码的多模态全产品线。
**影响:** 彭博认为,中国进展「进一步让人质疑美国在 AI 领域的科技主导地位能否长期维持」,并可能影响美国超大规模云厂商在 Anthropic、OpenAI 追逐万亿美元估值过程中的定价能力——若客户意识到开源/中国模型在核心基准上已与美国顶级闭源模型相差不足 3%,付费意愿与议价空间将被显著挤压。
**总结:** 彭博行业研究数据再度印证 DeepSeek V4.1 Flash 已将中美头部模型的性能差距压缩至 3%,与美国顶级模型仅差 2.3 分,标志着中国 AI 已实质性接近全球前沿,对美国出口管制战略和 AI 资本叙事构成新的考验。
**参考来源:**
1. https://www.straitstimes.com/world/united-states/us-lead-in-ai-over-china-narrows-after-deepseek-gains-bloomberg-intelligence-says
2. https://www.businesstimes.com.sg/international/us-lead-ai-over-china-narrows-after-deepseek-gains-report
3. https://startupfortune.com/deepseek-narrows-ai-gap-with-us-to-just-3-percent-bloomberg-says/
4. https://www.ithome.com/1/009/751.htm
5. https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
6. https://arxiv.org/abs/2609.19969
7. https://www.nownews.com/news/6880636







