快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →
研究院报告 新大陆研究院 约 1 分钟读完 素材来源 AIHOT

OpenAI 披露内部数据:自动化研究代理运行时长已达人工3.1倍

OpenAI 最新数据显示,其研究组织已实现自动化研究实习生里程碑,每投入1个人工工作日即运行3.1个agent工作日,标志着AI在受监督下可承接需数天的明确任务。此举或推动行业公开同类指标,但分析指出该比值仅反映运行量而非等效生产力。

OpenAI 于近日发布内部统计数据,宣称其研究团队已达到所谓的“自动化研究实习生”里程碑。该里程碑意味着,在人类监督下,AI代理已能完成此前需要熟练研究员耗费数天才能处理的明确任务,标志着自动化研究能力的一次关键跃升。

截至8月中旬的数据显示,OpenAI研究组织每投入1个人工工作日,就会伴随运行时长达3.1个agent工作日的自动化任务。需要强调的是,这一比值衡量的是运行时长,而非等效的生产力输出,因此不能简单视为AI已取代人类研究员的工作效率。

这一进展被部分OpenAI员工视为递归自我改进潜力的早期信号。有内部观点认为,随着AI代理在研发流程中承担更多环节,未来几年AI能力的增长可能越来越依赖于系统对自身改进过程的参与,而非仅靠外部人力驱动。

OpenAI同时呼吁其他AI公司公开类似的内部运行指标,以便行业更透明地评估自动化研究技术的实际进展与边界。此举或有助于建立统一的衡量标准,但也需警惕仅凭运行时长可能带来的误读。

业内分析指出,虽然3.1倍运行时长显示了自动化任务在量上的增长,但质量评估仍需更多维度数据支撑。这一里程碑的公布,或将促使更多企业效仿,推动AI研发效率的量化讨论走向深入。

OpenAI自动化研究AI代理行业趋势
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词