OpenAI 发布 GPT-6 Astra,ARC-AGI-3 基准得分 99.9%
OpenAI 于 9 月 4 日发布新一代模型 GPT-6 Astra,官方基准显示其 ARC-AGI-3 得分 99.9%,ExploitBench 达 100%。模型即日起向有限机构开放,未来几天将覆盖所有 ChatGPT 付费用户及 API、AWS 渠道。
人工智能领域的竞争格局在 9 月 4 日迎来新一轮震荡。OpenAI 官方于当日正式揭晓其下一代旗舰模型 GPT-6 Astra,并同步公开了该模型在多项核心基准测试中的表现数据,引发行业广泛关注。
根据 OpenAI 官网披露的基准结果,GPT-6 Astra 在 ARC-AGI-3 测试中取得 99.9% 的得分,达到该基准的饱和水平。与此同时,模型在 ExploitBench 上的成绩为 100%,显示出其在特定任务维度上的强劲能力。这些数字被官方描述为相较前代产品的"飞跃式提升"。
在部署安排上,OpenAI 采取了分阶段推进的策略。公告显示,GPT-6 Astra 于发布当日率先向有限的组织机构开放访问权限,随后的数天内将逐步扩展至所有 ChatGPT Plus、Pro、Business 及 Enterprise 用户。此外,该模型也将通过 OpenAI API 和亚马逊云服务(AWS)对外提供,这意味着企业级用户将能通过多种渠道接入这一新模型。
从行业视角观察,ARC-AGI-3 作为衡量通用人工智能进展的重要参考指标,其接近满分的结果无疑将重新划定当前前沿模型的能力边界。尽管官方基准与独立评测之间通常存在差异,但如此高的得分仍然为后续第三方验证设定了较高预期。对于依赖大模型构建应用的开发者与研究者而言,GPT-6 Astra 的开放节奏和渠道覆盖将直接影响其技术选型与产品迭代计划。
随着未来几天面向更广泛用户群的逐步推送,关于该模型在真实场景中的表现、推理效率以及潜在局限性的讨论预计将成为社区热点。OpenAI 此次发布能否延续其在生成式 AI 领域的技术引领地位,尚需市场与时间的进一步检验。