快讯 23:36AMD未发布锐龙9 5900X3D工程样品曝光:12核配32MB+96MB L3缓存16:00Ai2开源8B科学报告生成模型AstaBrief,已上线Asta平台08:00Epoch AI 测算:2025至2027年HBM产能可承载千万级并发前沿智能体 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

论文 今天 · 星期六 · 10-03 03:48 约 1 分钟读完

GPT-6.1 Sol (Max) 跻身 Agent Arena 前五,中位任务成本仅 0.56 美元

摘要

Arena 数据显示,OpenAI 的 GPT-6.1 Sol (Max) 在 Agent Arena 中排名第 5,较此前提升 11.23%,中位任务成本为 0.56 美元,并重新划定了该基准的 Pareto 前沿。

Agent Arena 最新榜单出现变动。Arena 公布的数据显示,OpenAI 的 GPT-6.1 Sol (Max) 已升至第 5 名,较此前提升 11.23%。

成本表现是此次排名变化的关键变量。该模型的中位任务成本为 0.56 美元,在进入前列的模型中处于较低水平,这意味着其排名提升并非单纯依赖性能堆叠。

伴随这一结果,Agent Arena 的 Pareto 前沿被重新划定。Pareto 前沿用于刻画性能与成本之间的最优权衡边界,GPT-6.1 Sol (Max) 的进入改变了该边界上原有模型的分布。

对关注 Agent 落地的团队而言,这一变化提供了新的性价比参照:在接近前列模型能力的同时,单任务成本被压至 0.56 美元,可能会影响后续模型选型与部署策略。

Agent ArenaGPT-6.1 SolOpenAI模型评测
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
57
企业落地案例
9
完整版提示词