OpenAI称拦截蒸馏攻击,研究者指Azure上同类手法仍可窃取模型推理
摘要
OpenAI披露7月拦截一起针对模型推理链的蒸馏窃取活动,涉及超4000用户、16000次请求和15000余个关联账号,并指向Moonshot AI相关人员。但研究者称,相同手法在Azure上仍可窃取GPT-6 Astra等模型的推理内容。
OpenAI对外披露,其在7月成功阻断了一起针对模型推理链的蒸馏窃取活动。该活动发生在7月24日至25日,请求来源覆盖超过4000名用户,累计请求量达到16000次,关联账号数量超过15000个。OpenAI将这一活动与Moonshot AI相关人员建立关联,并在7月28日采取了关停措施。
蒸馏窃取的核心在于对模型推理链的提取,而非简单的输出复制。攻击者通过大规模、分散化的请求模式,试图绕过常规的访问控制,从模型响应中还原出有价值的推理过程信息。OpenAI此次披露的数据显示,攻击在两天内即形成相当规模,账号与请求之间的比例也表明其使用了批量化的注册或调用策略。
不过,事件并未因OpenAI的关停而完全平息。有研究者指出,同样的攻击手法在Azure平台上依然可行,且目标包括GPT-6 Astra等模型的推理内容。这意味着,即便单一平台加强了拦截,跨云环境的模型服务仍可能面临同类风险。
对于AI行业而言,这一事件再次将模型推理链的安全边界推到台前。蒸馏攻击的隐蔽性和规模化潜力,使得平台侧的检测与响应速度成为关键变量。而研究者的补充发现则提示,模型安全并非某一家的孤立问题,跨平台、跨云的服务生态需要更协同的防护思路。
目前,OpenAI未就研究者的说法进一步置评,Azure方面亦无公开回应。事件后续进展仍有待观察。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗