Artificial Analysis 评测 Grok 4.7:智能指数46分,编码智能体指数56
摘要
Artificial Analysis 发布 Grok 4.7 评测报告,其智能指数得分46,较 Grok 4.6 提升2分,编码智能体指数升至56。这一成绩使 SpaceXAI 跻身全球前四大 AI 实验室行列。
第三方评测机构 Artificial Analysis 近日公布了对 Grok 4.7 的最新评估结果。数据显示,该模型在 Artificial Analysis Intelligence Index 上获得 46 分,较上一代 Grok 4.6 高出 2 分,呈现稳步迭代态势。
除综合智能指数外,Grok 4.7 在编码智能体指数(Coding Agent Index)上的得分为 56,同样成为本次评测的关注点之一。该指标用于衡量模型在编程任务与智能体场景中的表现,56 分的成绩反映出 Grok 4.7 在这一细分方向上的能力定位。
从实验室竞争格局看,此次得分使 SpaceXAI 进入前四大 AI 实验室之列。Artificial Analysis 的评测体系为业界提供了横向比较各模型能力的参照,Grok 4.7 的排名变化也意味着头部实验室之间的竞争进一步加剧。
目前 Artificial Analysis 公布的信息集中于上述两项指数得分及排名变动,更多细分维度的评测数据尚未在原文中披露。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗