9 月 26 日,X 平台用户 @arena 发布推文,公布了一项针对 Anthropic 旗下 Claude 模型写作指标的对比测试结果。测试聚焦于 Opus 5 与 Opus 5.5 两个版本,数据来源为 2026 年 8 月和 9 月的 Text Arena 高推理回复。
在 12 项写作指标中,有 10 项朝 Arena 所认定的改善方向变化。其中最显著的是破折号使用量的锐减:Opus 5 每 1,000 个单词出现 15.2 个破折号,而 Opus 5.5 降至 0.8 个,降幅约 95%。分号同样明显减少,从每 1,000 个单词 6.10 个下降至 1.64 个,降幅为 73%。这表明新模型在输出中减少了部分容易被识别为 AI 写作的标点模式。
句式层面也有调整。Opus 5.5 的平均句长为 10.03 个单词,低于 Opus 5 的 12.14 个单词,长句占比下降,措辞更趋简洁。不过,模型输出的总字数反而增加:Opus 5 的平均回答长度为 453 个单词,Opus 5.5 增至 481 个单词,成为此次对比中平均写作篇幅最长的 Opus 模型。
上述变化显示,Anthropic 在 Opus 5.5 上对文本生成风格进行了针对性调优,在压缩单句长度的同时扩展了整体回答容量,标点习惯的转变尤为突出。对于依赖模型输出进行内容生产的从业者而言,这一调整可能影响文本的可读性与人工润色成本。
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家 ↗