Did Codex Reset
GitHub

Claude Opus 5.5、Artificial Analysis Coding Agent Indexで66を記録

Artificial Analysis

Claude Codeの最大努力設定で、Claude Opus 5.5はArtificial Analysis Coding Agent Indexで66を記録し、Artificial Analysisが測定した最高点となった。Opus 5の60を6ポイント、Claude Fable 5.1の62を4ポイント上回る。この指数はTerminal-Bench 4.0、DeepSWE v1.1、SWE-Atlas-QnAを等しく重み付けする。

Opus 5.5はTerminal-Bench 4.0で63.1%に達し、Opus 5の54.5%から上昇した。DeepSWE v1.1では68.4%で、62.5%から上昇し、SWE-Atlas-QnAでは66.4%で、62.1%から上昇した。最も大きい上昇はTerminal-Benchの8.6ポイントである。

Artificial Analysisによると、AnthropicはOpusの料金を、入力100万トークンあたり5ドル、出力100万トークンあたり25ドルだったOpus 5から、それぞれ4ドルと20ドルに引き下げ、キャッシュ読み取りも100万トークンあたり0.50ドルから0.20ドルに下げた。それでもOpus 5.5のタスクあたり費用は13.04ドルで、Opus 5の10.79ドルを21%上回る。タスクあたりの使用量が約1140万トークンに対し約1560万トークンと多く、出力トークンは約2.4倍だからである。比較対象の中で、これより低コストで同じ得点に達したモデルはない。