Claude Opus 5.5 在 Artificial Analysis Coding Agent Index 上得分为 66
在 Claude Code 的最高努力档,Claude Opus 5.5 在 Artificial Analysis Coding Agent Index 上得分为 66,这是 Artificial Analysis 测得的最高分。该分数比 Opus 5 的 60 分高 6 分,比 Claude Fable 5.1 的 62 分高 4 分。该指数对 Terminal-Bench 4.0、DeepSWE v1.1 和 SWE-Atlas-QnA 给予同等权重。
Opus 5.5 在 Terminal-Bench 4.0 上达到 63.1%,高于 Opus 5 的 54.5%;在 DeepSWE v1.1 上达到 68.4%,高于 62.5%;在 SWE-Atlas-QnA 上达到 66.4%,高于 62.1%。增幅最大的是 Terminal-Bench,提高 8.6 个百分点。
Artificial Analysis 称,Anthropic 已将 Opus 的价格从 Opus 5 的每百万输入 token 5 美元、每百万输出 token 25 美元,分别下调至 4 美元和 20 美元,并将缓存读取价格从每百万 0.50 美元下调至 0.20 美元。Opus 5.5 的单任务成本仍为 13.04 美元,比 Opus 5 的 10.79 美元高 21%,原因是它每项任务约使用 1560 万 token,而 Opus 5 约为 1140 万,其中输出 token 约为后者的 2.4 倍。对比中没有任何成本更低的模型达到同样的分数。