9 月 17 日,据 CNBC 报道,Anthropic CEO Dario Amodei 提出一项针对前沿 AI 公司的监管设想:将独立第三方安全评估员长期嵌入企业内部,给予其接近内部风险团队的访问权限,并允许其在有限删减的前提下自主发布调查结果。Amodei 明确援引银行业嵌入式监管作为先例,称该提议在银行业有迹可循——监管“监督员”有时会与员工一起嵌入工作。
然而,多位银行业监管专家和 AI 评估从业者对此提出质疑。怀俄明大学法学院院长、银行业监管专家 Julie Andersen Hill 指出,银行监管者拥有切实的行政强制权。在大型银行,政府检查员常驻机构内部,可访问内部系统和员工,并能指令银行停止某项业务、限制增长、强制管理层变动,极端情况下可关闭银行。相比之下,Amodei 提议的评估员只拥有访问权和发布权,无法阻止模型的训练或发布,两者的实际权力不可同日而语。
这一提议的背景是,Anthropic 前研究员 Jacob Coxon 此前辞职并警告,前沿实验室正竞相追逐可能失控的系统。Amodei 在上周末发表的长文中承诺,Anthropic 将向第三方评估员提供与内部风险团队相当的系统访问权。他还警告,未来 6 到 12 个月内,一个错位的智能体群可能抢占互联网的大部分,并造成数千亿美元损失。
该文已引发 AI 社区及政府内部的监管分歧,包括美国总统特朗普在内。批评者的核心论点在于:评估员若没有叫停模型训练或发布的权力,就无法真正发挥监管作用——你不能既当运动员又当裁判。