Arena(arena.ai)平台于 9 月 7 日公布了 2026 年第 36 周(8 月 31 日至 9 月 6 日)的 AI 大模型盲测排名。本期榜单迎来多个重量级新模型,尤其国产模型在细分领域的表现引发关注。前端开发榜上,阿里 qwen3.8-max-0902 首次入榜即位列第 4,同门 qwen3.8-flash-next、腾讯 hy4-preview、智谱 glm-5.3-flash 也同步首次入榜并杀入前 15。
在 AI 视频生成榜中,阿里 wan3.0 首次亮相便直接冲进前三,展示了国产生成视频模型的最新竞争力。综合榜方面,头部排名整体稳定,claude-fable-5 以 1507 分蝉联榜首,claude-opus-4-6-high 以 1505 分紧随其后,两者仅差 2 分,在误差范围内。本周 Anthropic 的 claude-fable-5.1-max 首次入榜即位列第三,ELO 得分 1504 分。
该榜单基于 Arena 平台的匿名盲测投票,通过 ELO(智能体榜为百分比信号)计算排名,反映用户主观偏好而非绝对能力测试。不同分榜相互独立,不宜跨榜比较,分差在误差范围内均视为并列,新模型需积累一定投票量后才会正式入榜。
整体来看,头部格局仍以海外模型为主,但国产模型在细分领域的进步速度值得关注。阿里、腾讯、智谱等厂商的多款新模型集中上榜,显示出国内 AI 大模型在垂直场景的竞争力正在快速提升。
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家 ↗