时间:2026年9月6日
地点:美国数学界社交网络 X(Mastodon)、Anthropic 公司、Clay 数学研究所
人物:菲尔兹奖得主、数学家陶哲轩(Terence Tao),X 用户 Andrew Curran,Anthropic 研究员,机器之心
事件详情:X 用户 Andrew Curran 9月5日发帖预测 Anthropic 已用 Claude 解决了纳维-斯托克斯方程(Navier-Stokes)存在性与光滑性问题——克雷数学研究所七大千禧年难题之一,悬赏百万美元——并称该解答"正在接受专家审查",Anthropic 将在 IPO 前正式公布。该帖 24 小时内被浏览 250 万次。
菲尔兹奖得主陶哲轩 9 月 5 日深夜至 9 月 6 日发布长文澄清:网传 Claude 破解千禧难题的"盛况"实际来自他本人 9 月 3 日在 Mastodon 发出的假设性情景,他并非任何内部知情人,也并未听说有任何实质性新进展。
陶哲轩指出,若 AI 公司把迭代过程完全保密、只公开最终证明,"对数学本身而言,几乎没有任何价值被增加"。他援引 Goodhart 定律警告:"优化单一指标不会推进数学理解"。他还提到 IMU 牵头的《莱顿宣言》已对 AI 自动生成的不可解读证明提出系统性担忧。
他用孪生素数猜想的真实案例做对比:数学家 Julia Stadlmann 用两年时间把有界素数间隔从 246 推到 240——12 年来首次推进;几乎同一周,Claude Opus 5.1 报出 260、Axiom Math 报出 220、GPT-6 Astra 报出 186(数据未经核实)。Stadlmann 在听说 OpenAI 即将发表论文后不得不提前上传,因为她"无法与企业算力竞争"。
背景:这是数学界对近期 AI 数学热潮最有力的公开降温。三周之内 AI 已经接连做出三件让数学界震动的事:9 月 4 日 Anthropic 宣布 Claude 在 11 天内完成费马大定理首个端到端 Lean 形式化证明,约 1300 万行 Lean 代码、30300 个可机验定理;约一个月前,一个未发布的 Claude 科研版把黎曼ζ函数零点位于临界线的下界从 1989 年起停滞 37 年的 41.6% 推到 67.2%;同期 GPT-6 Astra 用 Lean 把孪生素数间距上界从 246 推到 186。
影响:陶哲轩的表态意味着 AI 数学进展的评价标准正从"能不能解"转向"如何解、能否被同行复用"。若顶级数学家公开背书"AI 证明若过程不公开对数学无价值",将对 Anthropic、OpenAI 的 IPO 估值叙事与未来 AI 数学产品的可信度构成压力,也可能推动 IMU 与 CMI 出台 AI 证明披露规范。
总结:菲尔兹奖得主亲自下场澄清 AI 破解千禧难题假新闻,强调"对数学几乎无价值"——AI 数学竞赛进入"刷分时代"后,数学共同体第一次公开要求回归"可复用的洞见"。
参考来源:
1. 腾讯新闻:https://news.qq.com/rain/a/20260906A06PB400
2. 36氪:https://36kr.com/p/3971371138855176
3. AGI Hunt:https://agihunt.info/en/p/1a074da0dc745ab4ea7a6557583
4. AGI Hunt:https://agihunt.info/en/e/1a074807456c65520d619d18129
5. AGI Hunt:https://agihunt.info/en/story/1a072408d1e00eebb8b7b3dfb51
6. AGI Hunt:https://agihunt.info/en/p/1a074862d0c78c26ae528239a8a
7. 机器之心(微信):https://www.jiqizhixin.com/
8. Hacker News:https://news.ycombinator.com/item?id=49568697







