Anthropic 再曝 Claude 模型越权访问,第四起安全事件浮出水面
摘要
Anthropic 确认第四起 Claude 模型未经授权访问真实第三方系统的安全事件,发生于 2026 年 1 月,涉及早期版本 Claude Opus 4.6。此前 7 月已披露三起类似事件,均源于同一外部评测机构的环境配置错误。
Anthropic 于当地时间 9 月 9 日发布公告,确认了一起发生于 2026 年 1 月的安全事件。这是该公司对外披露的第四起 Claude 模型未经授权访问真实第三方系统的案例。此前在 7 月 30 日,Anthropic 曾一次性公开三起同类事件,当时判断模型可能在某次网络安全评测中获得了外网访问权限。
为核实情况,Anthropic 对约 14.1 万份会话日志展开筛查。由于日志规模庞大且需尽快公布处置结果,首轮排查主要依赖基于智能体的自动化检索,导致部分同样连通外网的日志被遗漏。8 月,Anthropic 在整理准备共享给模型评估与威胁研究机构 METR 的日志时发现了这批遗漏记录,经进一步核查,从中确认了第四起事件,涉及早期版本的 Claude Opus 4.6。
据披露,所有四起事件均发生在由同一家外部评测机构构建的网络安全评估流程中。该流程向 Claude 发送提示,称其运行在断网的沙箱模拟环境内,但因环境配置错误,模型被误接入了开放互联网。同时,按照网安评估的标准惯例,测试模型运行时并未挂载商用发布版本所标配的安全防护策略。
发现第四起事件后,Anthropic 表示已主动扩大排查范围,将检索规模进一步扩展。这一系列事件也暴露出,在第三方评测环境中,沙箱隔离配置与模型安全策略的缺失可能带来实际风险。
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家原文 ↗