OpenAI 基金会董事会迎新成员,AI 对齐专家克里斯蒂亚诺发出失控警告
OpenAI 宣布保罗·克里斯蒂亚诺加入基金会董事会及安全与保障委员会。这位前对齐研究负责人警告,AI 系统失控风险已十分严峻,若无法在强有力对齐机制下构建超级智能,人类可能永久失去控制,甚至导致大多数人丧命,呼吁国内外协调降低风险。
北京时间 9 月 10 日,OpenAI 对外公布了一项人事任命:保罗·克里斯蒂亚诺(Paul Christiano)正式进入其基金会董事会。与此同时,他还将加入董事会下属的安全与保障委员会。这一安排将一位长期关注 AI 对齐问题的研究者推到了治理架构的前台。
克里斯蒂亚诺的履历与 AI 安全议题紧密交织。他曾在 OpenAI 主导对齐研究工作,此后转入美国联邦政府,担任美国国家标准与技术研究院(NIST)下属 AI 标准与创新中心的安全负责人。此番回归 OpenAI 治理层,他几乎在第一时间就公开表达了对超级智能风险的判断。
在 X 平台上,克里斯蒂亚诺直言,失去对 AI 系统控制的风险“如今已十分严峻”,行业需要投入更多精力让系统与人类利益保持一致。他进一步警告,如果未能在更强有力的对齐机制下构建超级智能,人类将永久性地失去对它的控制,“如果这种情况发生,那么大多数人可能会丧命”。在他看来,应对这一局面需要国内和国际层面的协调,以确保全球步调一致,将风险压到可接受的水平。
克里斯蒂亚诺还结合近期 AI 能力的发展轨迹与对齐工作持续面临的困难作出评估。他认为,存在一种切实的风险:AI 能力的快速加速可能在短期内导致灾难性且不可逆转的失控。他同时指出,包括 OpenAI 在内的整个 AI 行业,目前并未走在将这一风险降至可接受水平的轨道上。这一表态为 OpenAI 的治理层增添了来自对齐研究一线的警示声音。