时间:2026年10月9日(ARC Prize 官方账号 10/9 发布高分榜更新;ARC Daily 10/9 晨报同步记录公开榜观测数据)
地点:美国(ARC Prize 基金会组织的 Kaggle 竞赛 ARC Prize 2026 · ARC-AGI-2 赛道)
人物:独立研究小队 Tufa Labs,以及紧随其后的 rabbithole、Yi-Chia Chen、nvbanana 等个人与小团队参赛者
事件详情:10月9日,ARC Prize 官方在社交平台公布 ARC-AGI-2 高分榜最新进展,独立研究小队 Tufa Labs 把公开榜最高分从 83.61 提升到 88.06,进一步扩大领先优势。ARC Daily 10月9日晨报的逐条观测数据印证了这次跳升:第二名 rabbithole 保持 80.56,第三名 Yi-Chia Chen 77.22,第四名 nvbanana 77.08,四强之间最大差距已拉开到 11 分左右;其后 _hans 从 64.58 升至 67.64 升至第五,ALbert RUehlman 67.36 排第六,ARC Raiders 58.75 第七,Dawid Kopiczko 58.47 第八。10月7日的快照显示,当时公开榜首名分数为 83.61,公共奖牌金线在 37.36,参赛队伍已达 2556 支,个人与小团队占绝大多数。
背景:ARC Prize 2026 于 6月30日开赛,总奖金 200 万美元,设 ARC-AGI-2、ARC-AGI-3 与论文奖三条赛道,最终名次以私榜成绩为准,公开榜仅反映实时进度。ARC-AGI-2 是 ARC Prize 基金会 2025 年初推出的抽象推理基准,官方把它定位为"对前沿推理系统的压力测试",并以 85% 准确率作为关键门槛向参赛者发问。Tufa Labs 此前已凭开源方案 "Duck Harness" 拿下 ARC Prize 2026 的 ARC-AGI-3 里程碑奖第一名,此次又在 ARC-AGI-2 赛道登顶,成为唯一在两条赛道同时领跑的队伍;该小队由 Benjamin Crouzier 等人牵头,长期从事独立 AI 研究并习惯赛后开源解法。
影响:
- 独立小队压过资源密集型团队:88.06 分把抽象推理竞赛的天花板再次抬高,小团队用工程化 harness + 测试时计算就能在最难基准上持续走高
- 公开榜进入高频跳分阶段:10月7日 83.61 到 10月9日 88.06,四强差距扩大,私榜定奖牌前的最后冲刺会更激烈
- 开源解法持续外溢:Tufa Labs 先开源 ARC-AGI-3 方案再冲 ARC-AGI-2,赛后开源的惯例正在把竞赛技巧快速沉淀为公共研究资产
- 基准竞赛成为模型能力的独立参照:官方 85% 门槛之下,榜单前列成绩为观察前沿推理系统进展提供了公开、可核验的进度条
总结:ARC-AGI-2 高分榜在 10月9日被 Tufa Labs 推到 88.06,独立小队再次证明最难抽象推理基准上跑在最前面的未必是资源最多的团队。随着私榜截止临近,公开榜从 83.61 到 88.06 的这波跳升只是前奏,200 万美元奖金的最终归属还要看私榜结算;而赛后开源的惯例,会让这场竞赛的收益不止属于夺冠者。
参考来源:
https://x.com/arcprize/status/2108578092558250148
https://arc.markbarney.net/news/2026-10-09-morning-arc-2
https://arc.markbarney.net/news/2026-10-07-evening-arc-2-preview
https://arc.markbarney.net/kaggle-leaderboard/arc-2
https://arcprize.org/competitions/2026
https://arcprize.org/arc-agi/2
https://www.kaggle.com/competitions/arc-prize-2026-arc-agi-2
https://alphasignal.ai/company/arcprize
https://tufalabs.ai/research/
https://arcprize.org/blog/arc-prize-2026-milestone-1







