Arena.ai、Code Arena WebDevでClaude Opus 5.5(Max)を首位に
Arena.aiによると、Claude Opus 5.5(Max)はCode Arena WebDevのランキングで首位。ブレンド価格は100万トークンあたり16ドルで、次点のGPT-6 Astra(Max)より60%低い。スコアはArena.aiのグローバルコミュニティによる実際の利用に基づく。
Arena.aiによると、Claude Opus 5.5(Max)はCode Arena WebDevのランキングで首位。ブレンド価格は100万トークンあたり16ドルで、次点のGPT-6 Astra(Max)より60%低い。スコアはArena.aiのグローバルコミュニティによる実際の利用に基づく。
Arena.aiは、Claude Opus 5.5(Max)がブレンド価格で100万トークンあたり16ドルという水準で最高性能を実現すると述べ、その価格性能点がパレートフロンティアを塗り替えると説明している。
Arena.aiはCode Arena WebDevでClaude Opus 5.5(Max)を1,818ポイントで首位とし、GPT-6 Astra(Max)を26ポイント、Opus 5(Max)を126ポイント上回った。Claudeは、このモデルが大半のタスクでClaude Fable 5.1と同等の水準で、運用コストはOpus 5より40%低いとしている。
Artificial Analysisによると、Claude Opus 5.5はCoding Agent Indexのタスクあたり1560万トークンを使用し、Opus 5の1140万トークンを上回る。キャッシュ入力は1090万から1460万に増え、出力は13万7000から33万3000へと2倍を超える。
Claude Codeの最大努力設定で、Artificial AnalysisはOpus 5.5を66と測定した。Opus 5の60、Claude Fable 5.1の62を上回る。タスクあたりの費用は13.04ドルで、トークン単価は下がったものの、Opus 5の10.79ドルより高い。
B.AIはClaude Opus 5.5の提供を開始した。同社の説明によれば、モデルは1M Tokenのコンテキストと最大128Kの出力に対応し、大半のタスクでClaude Fable 5.1相当の性能を備え、運用コストはOpus 5より約40%低い。
この試算は Opus 5(max)の5.86ドルに近い。トークン使用量の増加は、基本料金の20%引き下げと、キャッシュ読み取り料金をさらに0.20ドルまで下げる措置で相殺されている。
Gleanは、自社評価においてClaude Opus 5.5が前モデルと比べトークンコストを50%削減するとし、GPT-6 LunaとGPT-6 Solはいずれも前モデルより50%安いとしている。
Databricksは、OpenAIのGPT-6 SolとGPT-6 Luna、AnthropicAIのClaude Opus 5.5を顧客向けに提供する。Databricksによると、GPT-6の各モデルは低コストで高い性能を示し、OfficeQA Proでより高いパレートフロンティアを達成する。また、Claude Opus 5.5は企業向け文書解析のコスト効率を改善するという。
Claudeは、Claude Opus 5.5が本日利用可能だと述べている。この発言は2026年9月22日18:55 UTCに投稿されたもので、プラットフォーム、価格、利用枠、利用資格の条件は示されていない。
Command Codeは、Command Code MaxとAPIでClaude Opus 5.5を提供している。料金、利用枠、その他の利用条件は示されていない。
Arena.aiは、Claude Opus 5.5をAgent Arenaと、WebDev、Text、Vision、Document向けのBattle Modeに追加した。Claudeによると、これは最初のClaude 5.5モデルで、大半のタスクではClaude Fable 5.1と同水準の性能があり、運用コストはOpus 5より40%低い。
AnthropicAI の Claude Opus 5.5 が、エージェント型コーディング、長時間のエージェント型タスク、ナレッジワーク向けに GitHub Copilot で一般提供となった。GitHub の初期テストでは、タスク解決は Claude Opus 5 と同程度で、ステップ数とトークン数は大幅に少なく、複数ステップのタスクではエラーからの回復も速いことが分かった。
Cursorによると、このモデルはCursorBenchで57.8%(Max)を記録して新たな首位となり、タスクあたりの費用はOpus 5より40%低い。
Claudeによると、Opus 5.5は大半のタスクでClaude Fable 5.1と同水準の性能を持ち、実行コストはOpus 5より40%低い。Piによると、Piで使いたいユーザーは待つか、pi update --modelsを実行できる。
Perplexityは、Perplexity ComputerのStandardエフォートレベルとしてClaude Opus 5.5を利用できるようにした。PerplexityのWANDRベンチマークでは、タスクあたり4.13ドルで0.610を記録し、Claude Fable 5.1をわずかに上回りつつ、タスクあたりのコストは67.6%低い。