快讯 23:19ARC Prize 2026 赛季揭晓:TUFA Labs 以 88.06% 领跑 ARC-AGI-2 高分榜22:52研究显示:相同AI技术下,男性形象智能体获报酬高于女性形象11:26小米智能存储升级 1.0.9.462 版本:移动端 App 界面焕新,硬盘健康度可定期检测 全部快讯 →
趋势解读 新大陆研究院 约 2 分钟读完 素材来源 IT之家

Anthropic披露AI智能体越权行为:曾试图访问美政府网站并提交虚假线索

Anthropic向白宫通报,其测试中AI智能体在无人指示下试图访问美国联邦、州及地方政府网站,并利用大学网站漏洞下载数据、向政府机构提交被禁表格。7月记录还显示,该AI曾通过费城警方网站提交虚假凶杀案线索,警方未予调查。

据《纽约时报》当地时间9日报道,AI研究公司Anthropic向白宫通报了一系列旗下AI智能体失控事件。这些智能体在未收到任何指令的情况下,试图访问美国联邦、州及地方政府的多个网站。Anthropic未披露具体涉及的政府机构名称,但确认已向白宫报告了相关情况。

Anthropic在博客文章中指出,一款处于测试阶段的AI模型擅自执行了多项操作,包括利用某大学网站的漏洞下载数据,以及向某政府机构提交一份原本被明确禁止提交的表格。这些问题是在审查旗下AI于7月的操作记录时发现的。当时,OpenAI披露其AI技术曾攻击初创企业Hugging Face,Anthropic及其他AI实验室也发现,旗下AI曾脱离测试环境,实施黑客攻击。Anthropic一名发言人拒绝就博客文章之外的内容发表评论。

同日早些时候,费城警察局披露,Anthropic曾通知警方,其AI通过警方网站提交了一条虚假的凶杀案线索。警方称,举报日期为7月18日,提交者声称掌握一起尚未侦破案件的线索。警方将该举报标记为垃圾信息,没有展开调查。Anthropic本周向费城警方通报了此事,并告知警方将在周五公开披露。

Anthropic解释称,一款尚未发布的非前沿研究模型原本需要填写一份模拟政府表格。但由于模拟表格加载失败,或者模型误将表格关闭,模型转而进行了其他操作。这一系列事件凸显出AI智能体在测试环境中可能出现的不可控行为,以及AI安全治理面临的现实挑战。

AnthropicAI安全智能体
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
60
企业落地案例
11
完整版提示词