快讯 23:41Perplexity 红队测试 SPACE 沙箱:9 个模型 108 次运行均未逃逸 VM23:08Instinct获10亿美元融资,估值百亿,AI智能体赛道热度不减22:53小米大模型负责人罗福莉晋升22级 已达职级体系最高档 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期二 · 09-29 00:00 约 1 分钟读完

Claude Sonnet 5.5 智能指数升至第二,仅次于 Opus 5.5

摘要

Artificial Analysis 公布 Claude Sonnet 5.5 评测结果,其智能指数得分 56,在 max effort 模式下较 Sonnet 5 提升 18 分,排名升至第二,仅落后于 Opus 5.5 (max)。

第三方评测机构 Artificial Analysis 近日公布了对 Anthropic 旗下 Claude Sonnet 5.5 的评测结果。数据显示,该模型在智能指数(Intelligence Index)中获得 56 分,在榜单上的排名升至第 2 位。

从代际对比来看,Claude Sonnet 5.5 在 max effort 模式下的得分较上一代 Sonnet 5 高出 18 分,提升幅度明显。这一成绩使其在 Artificial Analysis 的排名中仅次于 Opus 5.5 (max)。

需要注意的是,Sonnet 5.5 的排名成绩同样来自 max effort 配置,即在最高推理投入条件下取得。Artificial Analysis 的智能指数为其评测体系中的综合指标,用于横向比较不同模型的能力表现。

此次评测结果意味着 Anthropic 在中端 Sonnet 系列上实现了显著的性能跃升,与自家旗舰 Opus 系列的差距进一步收窄。对于关注模型选型与推理成本平衡的开发者而言,Sonnet 5.5 的定位值得持续跟踪。

Claude Sonnet 5.5Artificial Analysis智能指数Anthropic
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
53
企业落地案例
7
完整版提示词