时间:2026年9月20日
地点:美国旧金山 / 德国慕尼黑 / 英国牛津 / 法国巴黎
人物:OpenAI GPT-6 Astra、慕尼黑工业大学Patrick Becker、牛津大学Matthias Greger、巴黎九大/CNRS的Dominik Peter、Epoch AI
事件详情:全球顶级AI数学基准FrontierMath迎来首个"重大进展"(Major Advance)级开放难题被攻克。三位数学家与OpenAI旗舰模型GPT-6 Astra耗时数日,通过深度交互证明:2017年提出的"批准式委员会选举核是否可能为空"这一悬而未决9年的命题不存在反例,绝对公平的委员会在任何情况下都必定存在。Astra还引入了一套全新的"调和熵"目标函数,并给出多项式时间算法来计算最优委员会。
论文题为《Existence of the Core in Approval-Based Committee Elections》,9月10日提交至arXiv(编号2609.11912),共20页,存在性结果已用Lean形式化验证。Epoch AI随即为该题打上"Human+AI"标签,承认核心思路与证明由Astra在长程交互中提供,同时拒绝"模型自主完成"的更激进说法。
背景:FrontierMath是Epoch AI设计的研究级数学难题集,Tier 4为最高难度,共43题,其中6题被列为"Major Advance"级,长期无解。本题自2017年提出,旨在悬赏"核为空"的反例;GPT-6 Astra 9月4日发布以来,已在孪生素数猜想等方向取得连续突破,本次是该模型首个被官方认证的"重大进展"级解。
影响:数学界重新评估AI在原创研究中的角色——不再只是解题机器,而是能输出全新概念框架的"模式发现者"。Epoch新增"Human+AI"分类信号意义深远,意味着未来AI数学成果的认定将更看重人类与提示词工程师协同的强度,而非简单二元计数。同时也呼应OpenAI 8月发布论文中Astra自主解决10个长期开放问题的脉络,证明其在前沿数学的可持续输出能力。
总结:GPT-6 Astra与人类数学家联手攻克首个Major Advance级难题,但Epoch的克制标注提示行业:AI可成为高杠杆的数学协作者,但"独立发现"仍需人类把关。
参考来源:
1. 果壳:https://www.guokr.com/article/470272/
2. 36氪:https://36kr.com/p/3991214012775170
3. Ground Truth:https://groundtruth.day/news/frontiermath-core-approval-committee-elections.html
4. AGI Hunt(英文):https://agihunt.info/en/p/1a0bd184f2417bcf94109e185c8
5. AIBase:https://www.aibase.com/news/31195
6. AlphaSignal:https://alphasignal.ai/news/gpt-6-astra-cracks-a-decade-old-voting-theory-problem-nobody-could-solve
7. Epoch AI问题页:https://epoch.ai/frontiermath/open-problems/committee-election
8. 论文arXiv:https://arxiv.org/abs/2609.11912
9. 论文GitHub:https://github.com/DominikPeters/ABCVotingLean







