国产模型集体发力细分赛道:阿里、腾讯、智谱新模型首登 Arena 周榜
Arena 平台发布第 36 周 AI 大模型盲测排名,多款国产模型首次入榜即创佳绩:阿里 qwen3.8-max-0902 位列前端开发榜第四,wan3.0 冲入视频榜前三,腾讯、智谱新模型同步上榜。头部格局仍以海外模型为主,但国产模型细分领域突破显著。
Arena(arena.ai)平台于 9 月 7 日公布了 2026 年第 36 周(8 月 31 日至 9 月 6 日)的 AI 大模型盲测排名。本期榜单迎来多个重量级新模型,尤其国产模型在细分领域的表现引发关注。前端开发榜上,阿里 qwen3.8-max-0902 首次入榜即位列第 4,同门 qwen3.8-flash-next、腾讯 hy4-preview、智谱 glm-5.3-flash 也同步首次入榜并杀入前 15。
在 AI 视频生成榜中,阿里 wan3.0 首次亮相便直接冲进前三,展示了国产生成视频模型的最新竞争力。综合榜方面,头部排名整体稳定,claude-fable-5 以 1507 分蝉联榜首,claude-opus-4-6-high 以 1505 分紧随其后,两者仅差 2 分,在误差范围内。本周 Anthropic 的 claude-fable-5.1-max 首次入榜即位列第三,ELO 得分 1504 分。
该榜单基于 Arena 平台的匿名盲测投票,通过 ELO(智能体榜为百分比信号)计算排名,反映用户主观偏好而非绝对能力测试。不同分榜相互独立,不宜跨榜比较,分差在误差范围内均视为并列,新模型需积累一定投票量后才会正式入榜。
整体来看,头部格局仍以海外模型为主,但国产模型在细分领域的进步速度值得关注。阿里、腾讯、智谱等厂商的多款新模型集中上榜,显示出国内 AI 大模型在垂直场景的竞争力正在快速提升。