快讯 23:34Anthropic工程师解析Claude写作退化:模型被训练成写给AI而非人类23:31谷歌发布Gemini 3.8 Flash系列TTS模型,支持自然语言定制语音23:29AI安全事件与数学突破被指炒作,专家称责任在企业疏忽而非模型失控 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期四 · 09-24 02:54 约 1 分钟读完

四款新模型密集发布,智能指数与成本前沿新增十一个点位

摘要

Artificial Analysis 指出,本周 MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna 与 GPT-6 Sol 相继发布,在 Intelligence Index 与每任务成本构成的 Pareto 前沿上共新增十一个点位。其中 GPT-6 Luna 贡献五个,Claude Opus 5.5 贡献四个,模型能力与成本的权衡曲线被进一步推移。

本周 AI 模型赛道迎来一轮密集更新。据 Artificial Analysis 统计,MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna 和 GPT-6 Sol 四款模型在短时间内先后发布,成为观察当前模型能力与成本关系的最新样本。

该机构以 Intelligence Index 与每任务成本为坐标轴,衡量模型在智能水平与推理开销之间的取舍。四款新模型的加入,使这一 Pareto 前沿上新增了十一个点位,意味着可选的能力—成本组合明显增多。

从贡献分布看,GPT-6 Luna 是本次扩容的主要来源,独占五个点位;Claude Opus 5.5 紧随其后,贡献四个点位。MiMo-V2.6-Pro 与 GPT-6 Sol 同样参与其中,共同构成剩余点位的来源。

对于 AI 行业从业者而言,Pareto 前沿点位的增加通常意味着在同等预算下可匹配到更强模型,或在同等能力下拥有更低的每任务成本选项。本轮发布后,模型选型的空间与复杂度同步上升。

Artificial AnalysisGPT-6Claude Opus 5.5MiMo-V2.6-Pro
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
50
企业落地案例
6
完整版提示词