Anthropic 正在调整其面向网络安全领域的模型开放策略。据路透社报道,该公司将把过去半年间分别运行的两套项目合并为统一的“网络核验计划”(Cyber Verification Program,简称 CVP),并于当地时间周二正式对外公布。新计划的核心变化在于:经过资质审核的网络安全专业人员,将能够在更少安全防护限制的条件下测试 Anthropic 最强大的 AI 模型。
被整合的两套项目中,最受关注的是“玻璃翼计划(Project Glasswing)”。该计划面向负责关键软件安全防护的机构,开放 Claude Mythos 的使用权限——这是 Anthropic 旗下网络安全能力最强的模型系列。另一套则是旧版网络核验计划,向通过审核的安全团队提供防护限制下调后的 Claude Opus 以及 Claude Sonnet 模型。两者合并后,Anthropic 希望以统一入口管理外部安全研究者的模型访问。
从漏洞发现数据来看,这一策略已产生实际产出。玻璃翼计划的合作方在 4 月至 7 月期间,至少找到了 129000 个已经核实的漏洞;Anthropic 自身开展的开源扫描工作,在 4 月到 10 月之间又额外发现了 5500 个漏洞。截至目前,已有超过 33000 个漏洞被评定为严重或者高危等级。
Anthropic 同时提示,上述统计很可能存在遗漏。该公司表示,这些数据来自对有限数量合作方的调查,实际影响至少是目前数据的五倍。这一表态意味着,玻璃翼计划及开源扫描所触及的漏洞总量,可能远高于已披露的数字。对于依赖关键软件的各行业而言,AI 辅助漏洞挖掘的规模化效应正在显现,而 Anthropic 通过 CVP 进一步扩大测试范围,或将加速这一进程。