Did Codex Reset
GitHub

Claude Opus 5.5, Artificial Analysis Coding Agent Index에서 66점

Artificial Analysis

Claude Code에서 max effort로 실행한 Claude Opus 5.5는 Artificial Analysis Coding Agent Index에서 66점을 기록했으며, 이는 Artificial Analysis가 측정한 최고 점수다. Opus 5의 60점보다 6점, Claude Fable 5.1의 62점보다 4점 높다. 이 지수는 Terminal-Bench 4.0, DeepSWE v1.1, SWE-Atlas-QnA에 동일한 가중치를 둔다.

Opus 5.5는 Terminal-Bench 4.0에서 63.1%로 Opus 5의 54.5%보다 높고, DeepSWE v1.1에서 68.4%로 62.5%보다 높으며, SWE-Atlas-QnA에서 66.4%로 62.1%보다 높다. 가장 큰 상승폭은 Terminal-Bench의 8.6%포인트다.

Artificial Analysis에 따르면 Anthropic은 Opus 가격을 입력 토큰 100만 개당 5달러, 출력 토큰 100만 개당 25달러에서 각각 4달러와 20달러로 낮췄고, 캐시 읽기는 100만 개당 0.50달러에서 0.20달러로 낮췄다. Opus 5.5의 작업당 비용은 여전히 13.04달러로 Opus 5의 10.79달러보다 21% 높다. 작업당 토큰 사용량이 약 1,140만 개 대비 약 1,560만 개로 늘었고, 출력 토큰은 약 2.4배이기 때문이다. 비교 대상 중 더 저렴한 모델은 이 점수에 미치지 못한다.