辛顿等联署公开信:AI实验室须保障第三方评估独立性
摘要
AI评估机构论坛9月18日发布公开信,为第三方风险评估设定最低条件,要求Anthropic、OpenAI等实验室保障评估人员独立性、信息访问权及免受报复。辛顿、罗素等数十名AI人士联署。
9月18日,AI评估机构论坛发布一封公开信,针对Anthropic、OpenAI等AI实验室与外部评估机构的合作提出了一套最低标准。该论坛由多家监督组织组成,公开信获得数十名AI领域人士联署,其中包括计算机科学先驱杰弗里·辛顿和斯图尔特·罗素。
公开信的核心诉求围绕第三方评估人员的独立性与安全性展开。论坛指出,驻场评估人员必须具备科学客观性、透明度和独立性,并应得到充分保护,免受被评估企业的干预。具体而言,评估人员不仅应获准公开透明地开展工作,还应能直接与公司董事会及其他拥有特殊监督权限的机构沟通,不受企业过滤或限制,并有权公开发布评估结果。
在资源访问与人员构成方面,公开信主张第三方评估人员应获得与企业内部评估人员相同的系统、数据、工具和实体场所访问权限,同时避免因评估工作遭到AI实验室报复。此外,每家AI实验室都应引入观点和专业背景不同的评估人员,以覆盖生物科学风险、AI失控风险等多种风险领域。
这封公开信是对Anthropic CEO达里奥·阿莫迪和OpenAI CEO萨姆·奥尔特曼此前承诺的回应。两人曾表示将向第三方评估人员开放公司内部资源,并给予其与员工同等级别的信息访问权限。本周,网络上对AI风险的担忧迅速升温,评估机构论坛此时划出底线条件,意在推动企业承诺转化为可执行的合作框架。
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家原文 ↗