快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期日 · 09-13 04:18 约 1 分钟读完

Anthropic CEO 呼吁放缓前沿AI速度,公布三步安全计划

摘要

Anthropic CEO Dario Amodei 发布文章《We Must Pace the Frontier》,主张AI行业应放慢前沿发展速度,并提出三部分计划。Anthropic 单方面承诺第一步,为第三方评估者提供永久员工级系统访问权限,以核实安全措施执行、报告事故并评估训练期间模型的 alignment。

Anthropic 首席执行官 Dario Amodei 近日发表了一篇题为《We Must Pace the Frontier》的文章,提出AI行业应当放缓前沿技术的推进速度。这一呼吁正值全球AI竞赛持续升温之际,头部实验室不断刷新模型能力上限,而安全治理机制却尚未同步跟进。

Amodei 在文章中提出了一项三部分计划,旨在为前沿AI的发展建立更可控的节奏。该计划的核心在于通过外部监督与内部评估相结合的方式,确保安全措施能够被独立验证。Anthropic 方面已单方面承诺落实计划的第一步,即向第三方评估者开放永久的员工级系统访问权限。

根据文章披露的信息,这一权限将允许第三方评估者核实安全措施的实际执行情况、报告相关事故,并对训练期间模型的 alignment 进行评估。这意味着外部机构将获得与内部员工同等级别的系统访问能力,从而对 Anthropic 的前沿模型开发过程进行持续监督。

Amodei 的此次发声延续了其长期以来对AI安全议题的关注。在行业普遍追求更快迭代、更大参数的背景下,Anthropic 选择以开放系统访问权限的方式引入外部制衡,或将为前沿AI实验室的治理模式提供一种新的参考路径。

AnthropicDario AmodeiAI安全前沿模型
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词