Arena.ai 推出重新设计的排行榜概览
新概览汇总新加入模型、分类表现、能力说明和 Arena 动态的实时信号,并可展示 GPT-6 Sol、Claude Opus 5.5 等模型的跨竞技场分数。
新概览汇总新加入模型、分类表现、能力说明和 Arena 动态的实时信号,并可展示 GPT-6 Sol、Claude Opus 5.5 等模型的跨竞技场分数。
美国大学终身教职轨道教师可提交 2026 秋季提案,主题为人工智能评测的科学基础。每个项目最高可获 5 万美元,截止日期为 2026 年 10 月 30 日。
Arena.ai 表示,已生成 Anthropic 的 Claude Opus 5.5 与 OpenAI 的 GPT-6 Sol 的并排输出,Claude Opus 5.5 的评分即将公布。
Arena.ai 报告称,OpenAI 的 GPT-6 Sol (Max) 在 Code Arena: WebDev 中获得 1,689 分,排名第四,输入与输出混合价格为每百万 token 8 美元。该分数比 GPT-5.6 Sol (xHigh) 高 72 分,而 Arena.ai 表示 GPT-6 Luna 的分数仍待公布。
在 Arena.ai 上,两款模型均可在 Battle Mode 和 Agent Mode 中试用。
Arena.ai 已将 Claude Opus 5.5 加入 Agent Arena,以及面向 WebDev、Text、Vision 和 Document 的 Battle Mode。Claude 称,它是首个 Claude 5.5 模型,在多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%。