Arena.ai, Code Arena WebDev에서 Claude Opus 5.5 (Max) 1위
Arena.ai는 Claude Opus 5.5 (Max)가 Code Arena WebDev 순위에서 1위이며, 혼합 가격은 토큰 100만 개당 16달러로 다음 순위 모델 GPT-6 Astra (Max)보다 60% 낮다고 밝혔다. 점수는 Arena.ai 글로벌 커뮤니티의 실시간 실제 사용을 기준으로 한다.
Arena.ai는 Claude Opus 5.5 (Max)가 Code Arena WebDev 순위에서 1위이며, 혼합 가격은 토큰 100만 개당 16달러로 다음 순위 모델 GPT-6 Astra (Max)보다 60% 낮다고 밝혔다. 점수는 Arena.ai 글로벌 커뮤니티의 실시간 실제 사용을 기준으로 한다.
Arena.ai는 Claude Opus 5.5 (Max)가 혼합 가격 기준 토큰 100만 개당 16달러로 최고 성능을 제공한다고 밝혔으며, 이 가격 대비 성능 지점이 파레토 프론티어를 재편한다고 설명했다.
Arena.ai는 Code Arena WebDev에서 Claude Opus 5.5 (Max)를 1,818점으로 1위에 올렸다. GPT-6 Astra (Max)보다 26점, Opus 5 (Max)보다 126점 앞선다. Claude는 이 모델이 대부분 작업에서 Claude Fable 5.1 수준이며 실행 비용은 Opus 5보다 40% 낮다고 밝혔다.
Artificial Analysis에 따르면 Claude Opus 5.5는 Coding Agent Index 작업당 1,560만 토큰을 쓰며, Opus 5는 1,140만 토큰을 쓴다. 캐시된 입력은 1,090만에서 1,460만으로 늘고, 출력은 13만 7천에서 33만 3천으로 두 배 이상 증가한다.
Claude Code에서 max effort로 실행했을 때 Artificial Analysis가 측정한 Opus 5.5 점수는 66점으로, Opus 5의 60점과 Claude Fable 5.1의 62점을 웃돈다. 작업당 비용은 13.04달러로, 토큰 가격이 낮아졌음에도 Opus 5의 10.79달러보다 높다.
B.AI가 Claude Opus 5.5를 제공한다. B.AI에 따르면 이 모델은 1M 토큰 컨텍스트와 최대 128K 출력을 지원하며, 다수 작업 성능은 Claude Fable 5.1 수준이고 운영 비용은 Opus 5보다 약 40% 낮다.
이 추정치는 Opus 5 (max)의 5.86달러와 비슷하다. 토큰 사용량 증가는 기본 가격 20% 인하와 캐시 읽기 가격을 0.20달러로 추가 인하한 효과로 상쇄된다.
Glean은 자체 평가에서 Claude Opus 5.5의 토큰 비용이 이전 모델보다 50% 낮다고 밝혔으며, GPT-6 Luna와 GPT-6 Sol도 각각 이전 모델보다 50% 저렴하다고 했다.
Databricks가 고객에게 OpenAI의 GPT-6 Sol, GPT-6 Luna와 AnthropicAI의 Claude Opus 5.5를 제공한다. Databricks는 GPT-6 모델이 더 낮은 비용에서 강한 성능을 보이며 OfficeQA Pro에서 더 높은 파레토 프론티어를 기록한다고 밝혔고, Claude Opus 5.5는 기업 문서 파싱의 비용 효율을 개선한다고 설명했다.
Claude는 Claude Opus 5.5가 오늘 제공된다고 밝혔다. 이 내용은 2026년 9월 22일 18:55 UTC에 게시됐으며, 플랫폼, 가격, 할당량, 이용 자격 조건은 밝히지 않았다.
Command Code가 Command Code Max와 API를 통해 Claude Opus 5.5를 제공한다. 가격, 할당량, 그 밖의 이용 조건은 밝히지 않았다.
Arena.ai가 Claude Opus 5.5를 Agent Arena와 WebDev, Text, Vision, Document용 Battle Mode에 추가했다. Claude는 이 모델이 Claude 5.5 제품군의 첫 모델이며, 대부분의 작업에서 Claude Fable 5.1 수준으로 동작하고 Opus 5보다 실행 비용이 40% 낮다고 밝혔다.
AnthropicAI의 Claude Opus 5.5가 GitHub Copilot에서 에이전트 코딩, 장기 에이전트 작업, 지식 업무용으로 정식 제공된다. GitHub의 초기 테스트에서는 작업 해결 수준이 Claude Opus 5와 비슷하면서 단계와 토큰 사용량은 크게 줄고, 다단계 작업에서 오류 복구도 빨랐다.
Cursor는 이 모델이 CursorBench에서 57.8%(Max)로 새 최고 성적을 기록했으며, 작업당 비용이 Opus 5보다 40% 낮다고 밝혔다.
Claude는 Opus 5.5가 대부분의 작업에서 Claude Fable 5.1 수준으로 동작하며 Opus 5보다 실행 비용이 40% 낮다고 밝혔다. Pi는 Pi에서 이 모델을 쓰려는 사용자는 기다리거나 pi update --models를 실행할 수 있다고 밝혔다.
Perplexity가 Claude Opus 5.5를 Perplexity Computer의 Standard 작업 수준으로 제공하기 시작했다. Perplexity의 WANDR 벤치마크에서 작업당 4.13달러로 0.610점을 기록했으며, Claude Fable 5.1보다 소폭 높은 점수에 작업당 비용은 67.6% 낮았다.