Arena.ai 推出重新设计的排行榜概览
新概览汇总新加入模型、分类表现、能力说明和 Arena 动态的实时信号,并可展示 GPT-6 Sol、Claude Opus 5.5 等模型的跨竞技场分数。
新概览汇总新加入模型、分类表现、能力说明和 Arena 动态的实时信号,并可展示 GPT-6 Sol、Claude Opus 5.5 等模型的跨竞技场分数。
Arena.ai 将 Claude Opus 5.5(Max)排在 Code Arena WebDev 第一,得分为 1,818 分,领先 GPT-6 Astra(Max)26 分,高出 Opus 5(Max)126 分。Claude 表示,该模型在大多数任务上与 Claude Fable 5.1 相当,运行成本比 Opus 5 低 40%。
Arena.ai 给 SpaceXAI 的 Grok 4.7(xHigh)打出 1,632 分,比 Grok 4.6(High)高出 16 分、领先 6 个名次。Simulations 与 Consumer Product 的排名也有上升。
多语言 Controlled Voice Arena 排行榜比较 9 种新语言的文本转语音模型。现已提供可按语言筛选的排行榜、公开投票竞技场和评测方法。
在 Artificial Analysis 的排名中,没有任何单一开放权重文本转语音模型在全部九种语言上领先。Higgs Audio V3 TTS、OpenAudio S1 Mini、Voxtral TTS 和 Breeze TTS 2 分别在不同语言的开放权重榜上居首,且每个榜单只收录 2 到 6 个开放权重模型。
Controlled Voice Arena 现已对日语、普通话、印地语、西班牙语、德语、法语、葡萄牙语、越南语和阿拉伯语的文本转语音模型进行排名。Cartesia 的 Sonic 系列在九个榜单中的八个领先,Inworld AI 的 Realtime TTS-2 在普通话榜单排名第一。
Arena.ai 给 Qwen-Image-2.1 评出 1,228 分,在开源模型中排名第一,总榜第 17,比 Gemini-3-pro-image-preview 低 4 分,比 GPT-Image-1.5-high-fidelity 低 11 分。