快讯 23:53Shopify 弃用 React Native,AI 智能体重写 Shop 应用回归原生开发23:45Hugging Face CEO 谈被 NVIDIA 收购:借力招人,以十年周期押注开源 AI23:30NVIDIA 开源表格基础模型 Kumo Tabular,四项基准测试登顶 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期三 · 09-30 02:15 约 1 分钟读完

Claude Sonnet 5.5 (High) 登 Code Arena: WebDev 第四,性价比优势明显

摘要

Arena 数据显示,Claude Sonnet 5.5 (High) 在 Code Arena: WebDev 以 1699 分位列第四,混合价格约每百万 token 8 美元,比第二、三名便宜 80%。相比 Sonnet 5 (High) 的 1540 分提升 159 分,Reference-Based Design、Simulations、Gaming 三项均从第 30 多名跃升至第 4。

Arena 最新公布的 Code Arena: WebDev 榜单显示,Claude Sonnet 5.5 (High) 以 1699 分排名第四。这一成绩使其进入该细分领域的第一梯队,与头部模型的差距进一步缩小。

价格方面,Claude Sonnet 5.5 (High) 的混合成本约为每百万 token 8 美元。Arena 指出,这一价格比榜单第二、三名低 80%,意味着在相近性能区间内,该模型具备显著的成本优势。

与上一代 Sonnet 5 (High) 相比,Sonnet 5.5 (High) 的得分从 1540 分提升至 1699 分,增幅 159 分。更值得注意的是,在 Reference-Based Design、Simulations、Gaming 三个子项上,其排名均从第 30 多名跃升至第 4 名,显示出针对性的能力提升。

对于依赖 Web 开发场景的 AI 应用团队而言,Sonnet 5.5 (High) 在性能与价格之间的平衡,可能影响其模型选型与部署策略。Arena 的评测数据为这一判断提供了可量化的参考。

Claude Sonnet 5.5Code ArenaWebDev模型评测
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
54
企业落地案例
8
完整版提示词