Artificial Analysis评测:GPT-6双版本智能持平前代,单任务成本减半
摘要
Artificial Analysis最新评测显示,OpenAI的GPT-6 Sol和Luna在Intelligence Index上得分与各自前代GPT-5.6系列相近,但token定价下降约50%,使单任务成本减半。该机构图表展示了OpenAI各代模型在智能与成本之间的权衡曲线。
第三方评测机构Artificial Analysis近日发布了对OpenAI新一代模型GPT-6 Sol和Luna的评估结果。评测聚焦于模型智能水平与推理成本之间的平衡关系,为行业观察模型迭代效率提供了新的参考坐标。
在核心指标Intelligence Index上,GPT-6 Sol和Luna的得分与各自对应的前代GPT-5.6系列模型基本持平。这意味着新模型并未在综合智能评分上实现显著跃升,而是将优化重心放在了成本侧。
成本方面的变化更为突出。评测指出,GPT-6 Sol和Luna的token定价较前代下降约50%,直接推动单任务成本减半。对于依赖大规模API调用的开发者和企业用户而言,这一降幅意味着同等预算下可支撑的推理量翻倍。
Artificial Analysis同步公布的图表勾勒出OpenAI各代模型在智能与单任务成本之间的权衡曲线。从曲线走势看,GPT-6系列延续了以成本换效率的迭代路径,在智能增速放缓的背景下,单位智能的获取成本正在快速走低。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗