Grok 4.7 评测出炉:智能指数46分跻身前四,编码智能体升至第四
摘要
Artificial Analysis 公布 Grok 4.7 评测结果,xhigh 版本智能指数达 46 分,较 Grok 4.6 提升 2 分,助 SpaceXAI 进入前四。搭配 Grok Build 后,编码智能体指数从 47 升至 56,位列第四,仅次于 Claude Fable 5.1、GPT-6 Astra 和 Claude Opus 5。
第三方评测机构 Artificial Analysis 近日发布了针对 Grok 4.7 的基准测试结果。数据显示,Grok 4.7 在 xhigh 配置下的智能指数达到 46 分,这一成绩使其开发方 SpaceXAI 首次跻身该榜单前四名。
与上一代 Grok 4.6 相比,Grok 4.7 的智能指数提升了 2 分。在竞争激烈的大模型评测中,这一增幅虽不算显著,但足以推动排名变化,反映出模型迭代在综合能力上的持续优化。
在编码智能体这一细分维度上,Grok 4.7 搭配 Grok Build 后的表现更为突出。其编码智能体指数从 47 分跃升至 56 分,排名升至第四位。排在其前面的分别是 Claude Fable 5.1、GPT-6 Astra 和 Claude Opus 5。
此次评测结果意味着 Grok 系列在智能体编程场景中的竞争力进一步增强。编码智能体指数的大幅提升,可能对开发者工具选型和 AI 编程助手市场格局产生一定影响,后续表现值得关注。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗