Claude Sonnet 5.5领跑Coding Agent Index,单任务成本高达14.19美元
摘要
Artificial Analysis发布Coding Agent Index榜单,Claude Sonnet 5.5 (max)在Claude Code中以68分居首,但每任务成本最高达14.19美元;GPT-6.1 Sol与Gemini 4 Argon同样登顶,成本差异显著。
AI评测机构Artificial Analysis近日公布了新一期Coding Agent Index榜单,对当前主流编码代理工具进行了横向评测。该榜单以任务完成质量为核心指标,同时披露了各方案的单任务成本,为开发者选型提供了量化参考。
榜单显示,Claude Sonnet 5.5 (max)在Claude Code环境下以68分位列第一,成为本次评测中表现最优的编码代理组合。不过其代价同样突出——每任务成本最高达到14.19美元,在参评方案中处于成本高位。
与Claude Sonnet 5.5一同登顶的还包括GPT-6.1 Sol和Gemini 4 Argon,三者均进入榜单头部。但三者在成本维度上差异明显,意味着开发者在追求高分表现时,需要在性能与开销之间做出权衡。
此次榜单反映出编码代理赛道的一个现实:头部模型的能力差距正在收窄,而成本结构成为区分方案的关键变量。对于高频调用编码代理的团队而言,单任务成本将直接影响规模化部署的可行性。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗