Anthropic CEO 呼吁放缓前沿AI速度,公布三步安全计划
摘要
Anthropic CEO Dario Amodei 发布文章《We Must Pace the Frontier》,主张AI行业应放慢前沿发展速度,并提出三部分计划。Anthropic 单方面承诺第一步,为第三方评估者提供永久员工级系统访问权限,以核实安全措施执行、报告事故并评估训练期间模型的 alignment。
Anthropic 首席执行官 Dario Amodei 近日发表了一篇题为《We Must Pace the Frontier》的文章,提出AI行业应当放缓前沿技术的推进速度。这一呼吁正值全球AI竞赛持续升温之际,头部实验室不断刷新模型能力上限,而安全治理机制却尚未同步跟进。
Amodei 在文章中提出了一项三部分计划,旨在为前沿AI的发展建立更可控的节奏。该计划的核心在于通过外部监督与内部评估相结合的方式,确保安全措施能够被独立验证。Anthropic 方面已单方面承诺落实计划的第一步,即向第三方评估者开放永久的员工级系统访问权限。
根据文章披露的信息,这一权限将允许第三方评估者核实安全措施的实际执行情况、报告相关事故,并对训练期间模型的 alignment 进行评估。这意味着外部机构将获得与内部员工同等级别的系统访问能力,从而对 Anthropic 的前沿模型开发过程进行持续监督。
Amodei 的此次发声延续了其长期以来对AI安全议题的关注。在行业普遍追求更快迭代、更大参数的背景下,Anthropic 选择以开放系统访问权限的方式引入外部制衡,或将为前沿AI实验室的治理模式提供一种新的参考路径。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗