阶跃星辰 Step 5 Preview 获评 44 分,每任务成本仅为同级模型 1/2.8
摘要
Artificial Analysis 对阶跃星辰 Step 5 Preview 的评测结果显示,该模型 Intelligence Index 得分为 44 分,与 Kimi K3(max)持平,略低于 GLM-5.3(max)和 Qwen3.8 Max 的 45 分;每任务成本约 0.72 美元,约为同级模型 2.00 美元的 1/2.8。
第三方评测机构 Artificial Analysis 近日公布了对阶跃星辰旗下 Step 5 Preview 的评测结果,该模型在 Intelligence Index 中拿到 44 分,成为这一评测体系中又一款进入头部区间的国产模型。
从横向对比来看,Step 5 Preview 的得分与 Kimi K3(max)完全一致,均为 44 分;相较 GLM-5.3(max)和 Qwen3.8 Max 的 45 分,仅有一分之差。这一分布表明,上述几款模型在综合智能水平上处于同一梯队,彼此差距十分有限。
成本维度是此次评测的另一关注点。数据显示,Step 5 Preview 的每任务成本约为 0.72 美元,而同级模型的平均成本约为 2.00 美元,前者仅为后者的 1/2.8。在得分接近的前提下,这一成本差异意味着 Step 5 Preview 在单位智能的投入产出比上具备明显优势。
对于正在选型的开发者和企业用户而言,Intelligence Index 得分与每任务成本的组合,是衡量模型实际部署价值的重要参考。Step 5 Preview 此次在两项指标上的表现,为其在同级模型竞争中提供了一个值得关注的选项。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗