Artificial Analysis 评测 Grok 4.7:智能指数升至46分,编码代理得分56
摘要
Artificial Analysis 发布 Grok 4.7 评测,该模型在 Intelligence Index 得 46 分,较 Grok 4.6 高 2 分;AA-Briefcase 得 1657 Elo,提升 111 分,仅次于 Claude Opus 5 和 Claude Fable 5.1,编码代理得分升至 56。
第三方评测机构 Artificial Analysis 公布了对 Grok 4.7 的最新评估结果,从智能指数到知识工作与编码代理两个细分维度给出了完整分数。
在综合性的 Intelligence Index 上,Grok 4.7 拿到 46 分,相比上一代 Grok 4.6 提高 2 分,显示出模型整体能力的持续爬升。
更受关注的是面向知识工作场景的 AA-Briefcase 评测。Grok 4.7 在此项得到 1657 Elo,较此前提升 111 分,排名仅次于 Claude Opus 5 与 Claude Fable 5.1,意味着其智能体知识工作能力已进入前沿梯队。
编码代理方面,Grok 4.7 的得分升至 56,进一步印证该模型在代码相关任务上的进步。对开发者与 AI 从业者而言,这组数据提供了评估其实际落地价值的参考坐标。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗