快讯 23:34Anthropic工程师解析Claude写作退化:模型被训练成写给AI而非人类23:31谷歌发布Gemini 3.8 Flash系列TTS模型,支持自然语言定制语音23:29AI安全事件与数学突破被指炒作,专家称责任在企业疏忽而非模型失控 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期四 · 09-24 06:38 约 1 分钟读完

Artificial Analysis评测:GPT-6双版本智能持平前代,单任务成本减半

摘要

Artificial Analysis最新评测显示,OpenAI的GPT-6 Sol和Luna在Intelligence Index上得分与各自前代GPT-5.6系列相近,但token定价下降约50%,使单任务成本减半。该机构图表展示了OpenAI各代模型在智能与成本之间的权衡曲线。

第三方评测机构Artificial Analysis近日发布了对OpenAI新一代模型GPT-6 Sol和Luna的评估结果。评测聚焦于模型智能水平与推理成本之间的平衡关系,为行业观察模型迭代效率提供了新的参考坐标。

在核心指标Intelligence Index上,GPT-6 Sol和Luna的得分与各自对应的前代GPT-5.6系列模型基本持平。这意味着新模型并未在综合智能评分上实现显著跃升,而是将优化重心放在了成本侧。

成本方面的变化更为突出。评测指出,GPT-6 Sol和Luna的token定价较前代下降约50%,直接推动单任务成本减半。对于依赖大规模API调用的开发者和企业用户而言,这一降幅意味着同等预算下可支撑的推理量翻倍。

Artificial Analysis同步公布的图表勾勒出OpenAI各代模型在智能与单任务成本之间的权衡曲线。从曲线走势看,GPT-6系列延续了以成本换效率的迭代路径,在智能增速放缓的背景下,单位智能的获取成本正在快速走低。

Artificial AnalysisGPT-6OpenAI模型评测
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
50
企业落地案例
6
完整版提示词