快讯 23:38Dwarkesh Patel 对话 OpenAI 研究员 Noam Brown:聚焦多智能体系统与递归自我改进09:27GMO AIR推出日本首辆人形机器人专用救护车,配备工程师与诊断设备09:23加速进化推出Booster K1探索版人形机器人,标配豆包大模型售价38999元 全部快讯 →
实操专栏 新大陆研究院 约 2 分钟读完 素材来源 IT之家

Anthropic 公布 AI 研发自动化指数:Claude 已主导内部 26% 研发工作

Anthropic 发布衡量前沿 AI 实验室研发进度的方法,提出“Anthropic 研发自动化指数”,采用 AL0 至 AL5 六级体系评估 Claude 参与度。截至 2026 年 8 月,Claude 未实现完全自主运行,但已主导公司约 26% 的 AI 研发工作。

9 月 18 日,Anthropic 对外发布了一套面向前沿 AI 实验室的研发进度衡量方法,并同步披露公司内部的阶段性数据。这套体系围绕三个维度展开:AI 参与 AI 研发的程度、AI 智能体的监督情况,以及算力在 AI 研发与安全研究之间的分配比例。Anthropic 表示,随着模型能力持续提升,AI 正越来越多地介入下一代 AI 系统的研发流程,公开这些指标意在让公众、第三方机构和政府更直观地把握前沿研发的推进节奏。

在 AI 参与 AI 研发这一维度上,Anthropic 提出了“Anthropic 研发自动化指数”,专门衡量 Claude 参与公司 AI 研发工作的深度。该指数沿用 Epoch AI 的自动化等级框架,将参与程度划分为 AL0 到 AL5 六个层级:AL0 为没有 AI 参与,AL1 为 AI 辅助,AL2 为 AI 协作,AL3 为 AI 主导,AL4 为 AI 依据高层提示完成大部分任务、人类仅负责监督,AL5 则代表 AI 完全自主运行、无需人类介入。这一分级方式与汽车自动驾驶的评判逻辑相类似。

根据 Anthropic 公布的数据,截至 2026 年 8 月,Claude 尚未在任何被测量的 AI 研发工作中达到“完全自主运行”的 AL5 水平。不过,它已经“主导”了 Anthropic 约 26% 的 AI 研发工作,同时处于“AI 协作”层级。这意味着在部分研发环节中,Claude 已从辅助角色转向承担主要执行职责,但人类监督仍然存在。

值得注意的是,Anthropic CEO 达里奥·阿莫代伊此前曾呼吁协调放缓前沿 AI 的发展。Anthropic 在说明中指出,如果未来出现这种协调,相关数字预计会发生变化。此次公开的指标和方法,为外界观察前沿实验室内部 AI 参与研发的实际进度提供了一个可量化的参照。

AnthropicClaudeAI 研发自动化前沿 AI
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
41
企业落地案例
5
完整版提示词