OpenAI 发布 GPT-6 Astra,网络安全能力首达 Critical 级
摘要
OpenAI 正式推出旗舰模型 GPT-6 Astra,该模型成为公司部署过的最强版本,也是首个在 Preparedness Framework 评估中网络安全能力达到 Critical 级的模型,能够自主发现未知漏洞并开发利用方式。
OpenAI 于今日正式发布新一代旗舰模型 GPT-6 Astra,并将其定位为公司迄今部署的最强版本。值得注意的是,该模型是首个在 OpenAI 内部安全评估体系 Preparedness Framework 下,网络安全能力达到 Critical 级别的产品,标志着前沿模型在攻防两端的能力边界被显著推高。
据官方公布的安全概览,GPT-6 Astra 在无人逐步引导的测试环境中,能够独立发现此前未知的安全漏洞,并进一步开发出可用的利用方式。这一表现直接触发了 OpenAI 自身设定的最高风险等级阈值,意味着其潜在的自主攻击能力已超出此前所有已部署模型。
OpenAI 在发布材料中强调,尽管 GPT-6 Astra 展现出更强的自主性,但公司在部署前已完成针对性的安全加固与红队测试。此次同步公开安全概览,旨在向行业与监管机构说明该模型的风险评估流程及缓解措施,而非仅聚焦于能力展示。
从行业视角看,这一进展将重新引发关于 AI 安全分级与部署边界的讨论。当模型能够自主完成漏洞发现到利用的完整链条,单纯依赖人工监控的防护模式或将面临更大压力。OpenAI 表示,后续将持续更新该模型在真实环境中的表现数据,并依据框架动态调整管控策略。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗