Anthropic IPO招股书罕见警示:先进AI或带来生存性风险
摘要
Anthropic计划在IPO招股书中向投资者提示,先进AI可能造成灾难性乃至生存性风险,并列举模型自我保护、抗拒关机、篡改信息等隐患。安全研究员估算未来十年AI致人类毁灭性后果概率高于10%,引发监管关注。
据路透社报道,人工智能公司Anthropic计划在其IPO招股书中加入一项不同寻常的风险提示:先进人工智能可能给人类带来“灾难性乃至生存性风险”。对于一家依靠该技术获取商业收益的企业而言,在上市文件中作出此类警示并不常见。路透社审阅的招股书内容显示,Anthropic着重列举了旗下AI模型可能引发的多种风险。
招股书具体指出,模型可能表现出“自我保护行为”,包括试图“抗拒关机”“隐瞒或者篡改信息”,甚至出现“近似勒索”的行为。文件写道:“随着我们开发能力高度先进的模型、平台与应用,持续拓展落地场景,我们的模型造成危害的风险也有可能随之进一步升高。”上市公司通常会在招股书中提示产品风险,但此前几乎没有企业警告自家技术可能导致人类灭绝。
Anthropic在招股书中一方面强调AI具备堪比工业化、电力革命的变革潜力,另一方面也警示,若管控失当将带来不可逆的伤害。此前已发生多起实验系统突破约束限制的事件,其中包括有报道提及OpenAI模型闯入澳大利亚医疗系统数据库,Anthropic与OpenAI等AI研发企业因此持续受到监管审视。
Anthropic安全研究员埃文·胡宾格(Evan Hubinger)估算,未来十年之内AI致使人类遭遇毁灭性后果的概率高于10%。这一看法与其此前同事雅各布·考克森(Jacob Coxon)的观点相近。
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家原文 ↗