快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →
研究院报告 新大陆研究院 约 2 分钟读完 素材来源 AIHOT

Claude Fable 5.1 登顶智能指数,单任务成本较前代上浮20%

Anthropic 最新模型 Claude Fable 5.1 在 Artificial Analysis 智能指数评测中,以 max effort 模式 66 分成绩登顶榜首。但该模型单任务处理成本较 Fable 5 增加 20%,性能提升与成本上涨的平衡成为行业关注焦点。

Anthropic 于近期发布的新一代大语言模型 Claude Fable 5.1,在第三方评测机构 Artificial Analysis 的最新智能指数排行中取得突破性成绩。该机构对模型进行多维度能力测试,结果显示其在 max effort(最大努力)模式下获得 66 分,超越此前所有参测模型,正式登顶该榜单。

这一成绩意味着 Fable 5.1 在复杂推理、代码生成及多步任务处理等核心能力上,相较于前代 Fable 5 实现了可量化的提升。Artificial Analysis 的智能指数综合了多项基准测试结果,并针对不同推理强度设定进行分层评估,Fable 5.1 在最高强度设置下的表现尤为突出。

然而,性能跃升伴随着成本的同步上涨。根据同一份评测报告披露的数据,Fable 5.1 在单任务处理上的平均成本,比 Fable 5 高出约 20%。这一成本差异主要源于模型在 max effort 模式下需要消耗更多的计算资源,以支撑更深层的推理链条和更长的上下文处理。

对于企业级用户而言,性能与成本的权衡始终是部署决策的关键变量。20% 的单任务成本增幅,在批量调用场景下将显著影响总体预算。Anthropic 并未在本次评测中公布 Fable 5.1 的具体定价策略,但行业观察人士普遍认为,该模型定位高端应用场景,其溢价能否被下游客户接受,仍有待市场验证。

目前,Artificial Analysis 的榜单已成为不少开发团队选型的重要参考。Fable 5.1 的登顶,进一步加剧了头部大模型在推理能力上的竞争烈度。与此同时,成本曲线的上移也提醒行业,在追求极致智能的同时,效率优化与成本控制仍是商业化落地中不可回避的课题。

Claude Fable 5.1Artificial Analysis大模型评测成本分析
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词