Claude Sonnet 5.5 智能指数升至第二,仅次于 Opus 5.5
摘要
Artificial Analysis 公布 Claude Sonnet 5.5 评测结果,其智能指数得分 56,在 max effort 模式下较 Sonnet 5 提升 18 分,排名升至第二,仅落后于 Opus 5.5 (max)。
第三方评测机构 Artificial Analysis 近日公布了对 Anthropic 旗下 Claude Sonnet 5.5 的评测结果。数据显示,该模型在智能指数(Intelligence Index)中获得 56 分,在榜单上的排名升至第 2 位。
从代际对比来看,Claude Sonnet 5.5 在 max effort 模式下的得分较上一代 Sonnet 5 高出 18 分,提升幅度明显。这一成绩使其在 Artificial Analysis 的排名中仅次于 Opus 5.5 (max)。
需要注意的是,Sonnet 5.5 的排名成绩同样来自 max effort 配置,即在最高推理投入条件下取得。Artificial Analysis 的智能指数为其评测体系中的综合指标,用于横向比较不同模型的能力表现。
此次评测结果意味着 Anthropic 在中端 Sonnet 系列上实现了显著的性能跃升,与自家旗舰 Opus 系列的差距进一步收窄。对于关注模型选型与推理成本平衡的开发者而言,Sonnet 5.5 的定位值得持续跟踪。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗