Arena.ai 将 Claude Opus 5.5 (Max) 列为 Code Arena WebDev 第一
Arena.ai 称,Claude Opus 5.5 (Max) 在其 Code Arena WebDev 排名中位列第一,混合价格为每百万 token 16 美元,比排名其后的 GPT-6 Astra (Max) 低 60%。评分基于 Arena.ai 全球社区的实时使用。
Arena.ai 称,Claude Opus 5.5 (Max) 在其 Code Arena WebDev 排名中位列第一,混合价格为每百万 token 16 美元,比排名其后的 GPT-6 Astra (Max) 低 60%。评分基于 Arena.ai 全球社区的实时使用。
Arena.ai 称,Claude Opus 5.5(Max)以每百万 token 综合 16 美元的价格实现顶尖性能,并将这一性价比点描述为重塑了帕累托前沿。
Arena.ai 将 Claude Opus 5.5(Max)排在 Code Arena WebDev 第一,得分为 1,818 分,领先 GPT-6 Astra(Max)26 分,高出 Opus 5(Max)126 分。Claude 表示,该模型在大多数任务上与 Claude Fable 5.1 相当,运行成本比 Opus 5 低 40%。
Artificial Analysis 称,Claude Opus 5.5 在 Coding Agent Index 每项任务中使用 1560 万 token,而 Opus 5 为 1140 万。缓存输入从 1090 万增至 1460 万,输出从 13.7 万增至 33.3 万,增幅超过一倍。
在 Claude Code 的最高努力档,Artificial Analysis 测得 Opus 5.5 为 66 分,高于 Opus 5 的 60 分和 Claude Fable 5.1 的 62 分。其单任务成本为 13.04 美元,尽管 token 价格更低,仍高于 Opus 5 的 10.79 美元。
B.AI 已提供 Claude Opus 5.5。据其介绍,模型支持 1M Token 上下文和最高 128K 输出,多数任务性能达到 Claude Fable 5.1,运行成本较 Opus 5 降低约 40%。
这一估算接近 Opus 5(max)的 5.86 美元。更高的 token 用量被基础价格下调 20%,以及缓存读取价格进一步降至 0.20 美元所抵消。
Glean 表示,在 Glean 自身评测中,Claude Opus 5.5 的 token 成本较前代降低 50%;GPT-6 Luna 与 GPT-6 Sol 的价格也各自较前代低 50%。
Databricks 向客户提供 OpenAI 的 GPT-6 Sol、GPT-6 Luna 以及 AnthropicAI 的 Claude Opus 5.5。Databricks 表示,GPT-6 模型以更低成本实现较强表现,并在 OfficeQA Pro 上具有更高的帕累托前沿;Claude Opus 5.5 则提升了企业文档解析的成本效率。
Claude 称 Claude Opus 5.5 今日可用。该声明发布于 2026 年 9 月 22 日 18:55 UTC,未给出平台、价格、配额或使用资格。
Command Code 现已在 Command Code Max 及其 API 中提供 Claude Opus 5.5。未说明价格、配额或其他使用条件。
Arena.ai 已将 Claude Opus 5.5 加入 Agent Arena,以及面向 WebDev、Text、Vision 和 Document 的 Battle Mode。Claude 称,它是首个 Claude 5.5 模型,在多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%。
AnthropicAI 的 Claude Opus 5.5 已在 GitHub Copilot 全面可用,可用于智能体编程、长时间运行的智能体任务和知识工作。GitHub 的早期测试发现,其任务解决表现与 Claude Opus 5 相当,步骤和 token 用量显著更少,并在多步骤任务中能快速从错误中恢复。
Cursor 表示,该模型以 57.8%(Max)成为 CursorBench 的新榜首,且每项任务成本比 Opus 5 低 40%。
Claude 表示,Opus 5.5 在大多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%。Pi 表示,希望在 Pi 中使用该模型的用户可以等待,或运行 pi update --models。
Perplexity 已将 Claude Opus 5.5 作为 Perplexity Computer 的 Standard 努力级别开放使用。在 Perplexity 的 WANDR 基准测试中,其得分为 0.610,每项任务成本 4.13 美元,略优于 Claude Fable 5.1,同时每项任务成本低 67.6%。