Arena.ai 推出重新設計的 Leaderboard Overview
新總覽匯集新加入模型、分類表現、能力筆記同 Arena 新聞的即時訊號,並可顯示 GPT-6 Sol、Claude Opus 5.5 等模型的跨 arena 分數。
新總覽匯集新加入模型、分類表現、能力筆記同 Arena 新聞的即時訊號,並可顯示 GPT-6 Sol、Claude Opus 5.5 等模型的跨 arena 分數。
Arena.ai 將 Claude Opus 5.5 (Max) 列為 Code Arena WebDev 第一,得分 1,818,領先 GPT-6 Astra (Max) 26 分,並較 Opus 5 (Max) 高出 126 分。Claude 表示,該模型在大多數任務上的表現與 Claude Fable 5.1 相當,運行成本較 Opus 5 低 40%。
Arena.ai 給 SpaceXAI 的 Grok 4.7(xHigh)評為 1,632 分,較 Grok 4.6(High)高 16 分、排名上升 6 位。Simulations 與 Consumer Product 的排名亦有上升。
多語言 Controlled Voice Arena 排行榜比較 9 種新語言的文字轉語音模型。可按語言選擇的排行榜、公開投票競技場及評測方法均已提供。
在 Artificial Analysis 的排名中,沒有單一開源權重文字轉語音模型在全部九種語言領先。Higgs Audio V3 TTS、OpenAudio S1 Mini、Voxtral TTS 與 Breeze TTS 2 各自在不同語言的開源權重組別居首,而每個榜單只收錄 2 至 6 個開源權重模型。
Controlled Voice Arena 現為日語、普通話、印地語、西班牙語、德語、法語、葡萄牙語、越南語及阿拉伯語的文字轉語音模型排名。Cartesia 的 Sonic 系列在九個榜單中的八個領先,Inworld AI 的 Realtime TTS-2 則在普通話榜排名第一。
Arena.ai 給予 Qwen-Image-2.1 1,228 分,並在開源模型中排第一、總排名第 17,落後 Gemini-3-pro-image-preview 四分,落後 GPT-Image-1.5-high-fidelity 11 分。