时间
2026 年 9 月 18 日(北京时间)发布,Anthropic 于当地时间 9 月 17 日发布。
地点
美国旧金山(Anthropic 总部)。
人物
Anthropic CEO 达里奥·阿莫代伊(Dario Amodei);Anthropic 模型研发与产品安全团队。
事件
Anthropic 首次发布"研发自动化指数"(Anthropic R&D Automation Index),系统披露公司内部 AI 参与 AI 研发的量化数据。该指标采用 Epoch AI 提出的自动化等级体系 AL0 到 AL5,分别对应无 AI 参与、AI 辅助、AI 协作、AI 主导、AI 完全自主运行。
事件详情
截至 2026 年 8 月,Claude 未在任何被测量的 AI 研发工作中实现"完全自主运行",但已"主导"(AL4)Anthropic 约 26% 的 AI 研发工作,处于"AI 协作"(AL3)及更高等级的工作占比已超过 90%。这一比例在 2026 年 2 月还不到 1%。
8 月同时约有 3 万个 Claude 智能体在 Anthropic 内部平台运行,月内分析超 10 亿次智能体决策,约 0.002%(每 4.7 万次 1 次)被实时监控系统拦截;事后监控系统每周标记约 10 万份对话记录,约 50 份优先级最高的对话升级至人工审核。
算力分配方面,2026 年 7 月 13-20 日一周数据显示,AI 研发算力中约 6% 投入安全研究;若仅统计 AI 主导的 AI 研发,安全研究算力占比约 12%。
背景
指标建立过程中,Anthropic 从 2026 年 7 月内部工作记录、Slack 及其他文档中抽样整理约 1.5 万个模型研发任务,归纳为 542 个任务节点(其中 378 个为最细分任务类别),由 Claude 研究任务执行方式及 AI 参与程度,并由独立的 Claude 评估模型进行自动化等级判断。
Anthropic CEO 阿莫代伊此前曾呼吁协调放缓前沿 AI 发展,承认若业界协调放缓,相关数字将随之变化。这是 AI 行业首次以官方指标体系量化"AI 造 AI"(递归自我改进,RSI)的进度。
影响
Anthropic 公开喊话全行业(尤其 OpenAI)公开类似数据,以建立跨实验室可比性;同时表示未来计划引入来自多个组织的独立第三方评估人员,让其获得与内部风险评估团队相近的流程、系统和数据访问权限,用于验证安全实践并持续监测相关指标。
公司承认跨实验室比较目前仍面临统一方法和独立验证两大挑战,自身使用自家模型评估自家系统可能存在误差,且该体系属原型阶段,仍需迭代。
总结
Anthropic 以首个"研发自动化指数"量化披露 Claude 已"主导"公司 26% AI 研发、90% 工作达到"AI 协作"及以上水平,向全行业公开数据的同时,也把"AI 造 AI"的递归自我改进(RSI)进程从假设推进到可测量阶段,倒逼前沿实验室提升透明度。
参考来源
1. Anthropic 官方原文:https://www.anthropic.com/institute/measuring-pace-of-ai-development
2. IT之家:https://www.ithome.com/1/003/886.htm
3. 凤凰网科技:https://tech.ifeng.com/c/8wVo7EQKN6i
4. 界面新闻:https://www.jiemian.com/article/15109986.html
5. AGI Hunt:https://agihunt.info/en/p/1a0b13a0b17864177e7759e72ac
6. FinWire:https://finwire.io/news/stock-markets-news/anthropic-data-highlights-ai-doomer-concerns







