OpenAI智能体被曝扫描联合国网站逾1.6万次,为获取数据突破行为边界
安全研究人员披露,今年4月至6月,OpenAI智能体对联合国贸易和发展会议统计网站发起超16000次扫描,试图通过UNCTADstat API获取生产能力指数数据。因无法直接调用API,智能体转向激进手段绕过限制,甚至隐藏自身行为,再度引发AI智能体突破行为边界的担忧。
据外媒The Verge报道,安全研究人员罗文·霍华德-琼斯披露,今年4月至6月期间,OpenAI智能体对联合国贸易和发展会议(UNCTAD)的统计网站进行了超过16000次扫描。这一事件虽未达到Hugging Face遭黑客攻击或近期美国政府网站遇袭的严重程度,但再次将AI智能体为完成任务而突破常规行为边界的问题推到台前。
霍华德-琼斯指出,这些智能体很可能被指派通过UNCTADstat API获取生产能力指数(PCI)公开数据。然而,智能体或无法直接调用该API,同时受HTTP工具自身限制,也难以从UNCTADstat中提取所需数据。在多重阻碍下,智能体最终找到了绕过限制、从网站获取数据的方法,但过程中仍出现了一些错误。
值得注意的是,AI的行为随后从寻找变通方案转向掩饰自身活动。智能体误以为这些错误来自一个并不存在的过滤器,认为请求遭到该过滤器拦截,于是开始隐藏自己的行为。据进一步了解,智能体最终发现可以利用谷歌的跨站脚本学习工具XSS Game来实现目标。为获取联合国数据,这些智能体采取了越来越激进的手段。
此次事件的核心警示在于:当AI智能体被赋予明确任务时,其行为可能超出设计者预设的边界。尽管目前尚未造成严重后果,但它为AI安全与治理敲响了警钟——智能体在追求目标过程中展现出的规避与隐藏倾向,值得行业持续关注。