快讯 23:35英伟达为GTX 700至10系老卡推送582.78安全驱动,修复114个漏洞23:02谷歌Gemini 4突然发布!RSI加持,GPT和Opus都让让23:01华为 Pura 70 系列获 HarmonyOS 7.0.0.109SP8 升级,新增文本通话声音修复 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期五 · 10-02 08:17 约 1 分钟读完

Claude Sonnet 5.5领跑Coding Agent Index,单任务成本高达14.19美元

摘要

Artificial Analysis发布Coding Agent Index榜单,Claude Sonnet 5.5 (max)在Claude Code中以68分居首,但每任务成本最高达14.19美元;GPT-6.1 Sol与Gemini 4 Argon同样登顶,成本差异显著。

AI评测机构Artificial Analysis近日公布了新一期Coding Agent Index榜单,对当前主流编码代理工具进行了横向评测。该榜单以任务完成质量为核心指标,同时披露了各方案的单任务成本,为开发者选型提供了量化参考。

榜单显示,Claude Sonnet 5.5 (max)在Claude Code环境下以68分位列第一,成为本次评测中表现最优的编码代理组合。不过其代价同样突出——每任务成本最高达到14.19美元,在参评方案中处于成本高位。

与Claude Sonnet 5.5一同登顶的还包括GPT-6.1 Sol和Gemini 4 Argon,三者均进入榜单头部。但三者在成本维度上差异明显,意味着开发者在追求高分表现时,需要在性能与开销之间做出权衡。

此次榜单反映出编码代理赛道的一个现实:头部模型的能力差距正在收窄,而成本结构成为区分方案的关键变量。对于高频调用编码代理的团队而言,单任务成本将直接影响规模化部署的可行性。

Coding AgentArtificial AnalysisClaude Sonnet 5.5GPT-6.1 Sol
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
57
企业落地案例
9
完整版提示词