快讯 23:45苹果 2026 款 Mac mini 明日开售:M6 与 M5 Pro 双芯片,6999 元起23:40苹果2026款Mac Studio开售:M5 Max与Ultra双芯,19999元起23:32苹果 M6 Mac mini 首发 2nm 制程,实测对比上代性能提升 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期二 · 09-22 03:41 约 1 分钟读完

Artificial Analysis 评测 Grok 4.7:智能指数升至46分,编码代理得分56

摘要

Artificial Analysis 发布 Grok 4.7 评测,该模型在 Intelligence Index 得 46 分,较 Grok 4.6 高 2 分;AA-Briefcase 得 1657 Elo,提升 111 分,仅次于 Claude Opus 5 和 Claude Fable 5.1,编码代理得分升至 56。

第三方评测机构 Artificial Analysis 公布了对 Grok 4.7 的最新评估结果,从智能指数到知识工作与编码代理两个细分维度给出了完整分数。

在综合性的 Intelligence Index 上,Grok 4.7 拿到 46 分,相比上一代 Grok 4.6 提高 2 分,显示出模型整体能力的持续爬升。

更受关注的是面向知识工作场景的 AA-Briefcase 评测。Grok 4.7 在此项得到 1657 Elo,较此前提升 111 分,排名仅次于 Claude Opus 5 与 Claude Fable 5.1,意味着其智能体知识工作能力已进入前沿梯队。

编码代理方面,Grok 4.7 的得分升至 56,进一步印证该模型在代码相关任务上的进步。对开发者与 AI 从业者而言,这组数据提供了评估其实际落地价值的参考坐标。

Grok 4.7Artificial Analysis模型评测编码代理
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
45
企业落地案例
5
完整版提示词