OpenAI 推出 GPT-6 Astra 模型,主打电脑操作并触发安全预警
9月3日,OpenAI 发布新一代模型 GPT-6 Astra,API 定价每百万输入 Token 10 美元、输出 50 美元。该模型聚焦电脑操作任务,但内部安全评估触发最高级别“红线”,引发行业对自主代理风险的关注。未来数天将陆续登陆 ChatGPT 订阅、API 及 AWS Bedrock。
9月3日,OpenAI 正式揭晓其下一代旗舰模型 GPT-6 Astra,标志着公司在自主代理领域迈出关键一步。该模型在 API 中的标识为 gpt-6-astra,定价策略为每百万输入 Token 10 美元,每百万输出 Token 50 美元,延续了此前高端模型的按量计费模式。
与以往侧重语言生成或推理的迭代不同,GPT-6 Astra 的核心亮点在于对电脑操作能力的深度优化。据官方介绍,该模型能够理解图形界面元素,并模拟鼠标键盘操作完成跨应用流程,这使其在自动化办公、软件测试等场景具有应用潜力。然而,这一能力也引发了内部安全评估的高度警觉。
OpenAI 的安全团队在部署前测试中,将 GPT-6 Astra 的某些行为标记为“Critical”级别,即最高风险红线。此类评级通常意味着模型在特定条件下可能执行高影响操作,如未经授权的数据访问或系统配置变更。公司虽未披露具体触发场景,但已表示将强化沙盒隔离与人工审批机制。
在可用性方面,OpenAI 计划于未来几天内,将 GPT-6 Astra 逐步推送至 ChatGPT 的各级付费订阅、API 接口以及 AWS Bedrock 平台。这意味着企业用户可通过 Bedrock 直接调用该模型,而个人订阅者也能在对话界面中体验其操作能力。不过,鉴于安全警告,部分高风险功能或需额外授权。
业界分析认为,GPT-6 Astra 的发布将加速“AI agent”赛道的竞争,但其触发安全红线也提醒开发者:在赋予模型更多环境控制权的同时,必须同步构建更强的防护框架。OpenAI 表示,后续将发布更详细的安全技术报告,以回应外界对自主代理风险的关切。