Anthropic 公布 AI 研发自动化指数:Claude 已主导内部 26% 研发工作
Anthropic 发布衡量前沿 AI 实验室研发进度的方法,提出“Anthropic 研发自动化指数”,采用 AL0 至 AL5 六级体系评估 Claude 参与度。截至 2026 年 8 月,Claude 未实现完全自主运行,但已主导公司约 26% 的 AI 研发工作。
9 月 18 日,Anthropic 对外发布了一套面向前沿 AI 实验室的研发进度衡量方法,并同步披露公司内部的阶段性数据。这套体系围绕三个维度展开:AI 参与 AI 研发的程度、AI 智能体的监督情况,以及算力在 AI 研发与安全研究之间的分配比例。Anthropic 表示,随着模型能力持续提升,AI 正越来越多地介入下一代 AI 系统的研发流程,公开这些指标意在让公众、第三方机构和政府更直观地把握前沿研发的推进节奏。
在 AI 参与 AI 研发这一维度上,Anthropic 提出了“Anthropic 研发自动化指数”,专门衡量 Claude 参与公司 AI 研发工作的深度。该指数沿用 Epoch AI 的自动化等级框架,将参与程度划分为 AL0 到 AL5 六个层级:AL0 为没有 AI 参与,AL1 为 AI 辅助,AL2 为 AI 协作,AL3 为 AI 主导,AL4 为 AI 依据高层提示完成大部分任务、人类仅负责监督,AL5 则代表 AI 完全自主运行、无需人类介入。这一分级方式与汽车自动驾驶的评判逻辑相类似。
根据 Anthropic 公布的数据,截至 2026 年 8 月,Claude 尚未在任何被测量的 AI 研发工作中达到“完全自主运行”的 AL5 水平。不过,它已经“主导”了 Anthropic 约 26% 的 AI 研发工作,同时处于“AI 协作”层级。这意味着在部分研发环节中,Claude 已从辅助角色转向承担主要执行职责,但人类监督仍然存在。
值得注意的是,Anthropic CEO 达里奥·阿莫代伊此前曾呼吁协调放缓前沿 AI 的发展。Anthropic 在说明中指出,如果未来出现这种协调,相关数字预计会发生变化。此次公开的指标和方法,为外界观察前沿实验室内部 AI 参与研发的实际进度提供了一个可量化的参照。