快讯 23:59阿里预判三年内原生全模态统一生成模型将落地23:46Agent时代,CPU的价值该重估了22:35Meta macOS AI助手Muse曝0-day漏洞:本地应用可窃取账户令牌 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期三 · 09-23 00:00 约 1 分钟读完

Grok 4.7 评测出炉:智能指数46分跻身前四,编码智能体升至第四

摘要

Artificial Analysis 公布 Grok 4.7 评测结果,xhigh 版本智能指数达 46 分,较 Grok 4.6 提升 2 分,助 SpaceXAI 进入前四。搭配 Grok Build 后,编码智能体指数从 47 升至 56,位列第四,仅次于 Claude Fable 5.1、GPT-6 Astra 和 Claude Opus 5。

第三方评测机构 Artificial Analysis 近日发布了针对 Grok 4.7 的基准测试结果。数据显示,Grok 4.7 在 xhigh 配置下的智能指数达到 46 分,这一成绩使其开发方 SpaceXAI 首次跻身该榜单前四名。

与上一代 Grok 4.6 相比,Grok 4.7 的智能指数提升了 2 分。在竞争激烈的大模型评测中,这一增幅虽不算显著,但足以推动排名变化,反映出模型迭代在综合能力上的持续优化。

在编码智能体这一细分维度上,Grok 4.7 搭配 Grok Build 后的表现更为突出。其编码智能体指数从 47 分跃升至 56 分,排名升至第四位。排在其前面的分别是 Claude Fable 5.1、GPT-6 Astra 和 Claude Opus 5。

此次评测结果意味着 Grok 系列在智能体编程场景中的竞争力进一步增强。编码智能体指数的大幅提升,可能对开发者工具选型和 AI 编程助手市场格局产生一定影响,后续表现值得关注。

Grok 4.7Artificial Analysis编码智能体模型评测
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
45
企业落地案例
5
完整版提示词