快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

论文 今天 · 星期一 · 09-07 16:34 约 1 分钟读完

国产模型集体发力细分赛道:阿里、腾讯、智谱新模型首登 Arena 周榜

摘要

Arena 平台发布第 36 周 AI 大模型盲测排名,多款国产模型首次入榜即创佳绩:阿里 qwen3.8-max-0902 位列前端开发榜第四,wan3.0 冲入视频榜前三,腾讯、智谱新模型同步上榜。头部格局仍以海外模型为主,但国产模型细分领域突破显著。

Arena(arena.ai)平台于 9 月 7 日公布了 2026 年第 36 周(8 月 31 日至 9 月 6 日)的 AI 大模型盲测排名。本期榜单迎来多个重量级新模型,尤其国产模型在细分领域的表现引发关注。前端开发榜上,阿里 qwen3.8-max-0902 首次入榜即位列第 4,同门 qwen3.8-flash-next、腾讯 hy4-preview、智谱 glm-5.3-flash 也同步首次入榜并杀入前 15。

在 AI 视频生成榜中,阿里 wan3.0 首次亮相便直接冲进前三,展示了国产生成视频模型的最新竞争力。综合榜方面,头部排名整体稳定,claude-fable-5 以 1507 分蝉联榜首,claude-opus-4-6-high 以 1505 分紧随其后,两者仅差 2 分,在误差范围内。本周 Anthropic 的 claude-fable-5.1-max 首次入榜即位列第三,ELO 得分 1504 分。

该榜单基于 Arena 平台的匿名盲测投票,通过 ELO(智能体榜为百分比信号)计算排名,反映用户主观偏好而非绝对能力测试。不同分榜相互独立,不宜跨榜比较,分差在误差范围内均视为并列,新模型需积累一定投票量后才会正式入榜。

整体来看,头部格局仍以海外模型为主,但国产模型在细分领域的进步速度值得关注。阿里、腾讯、智谱等厂商的多款新模型集中上榜,显示出国内 AI 大模型在垂直场景的竞争力正在快速提升。

Arena大模型国产模型盲测榜单
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词