Arena.ai, 개편된 Leaderboard Overview 출시
새 개요는 신규 추가 모델, 카테고리별 성능, 역량 메모, Arena 뉴스의 실시간 신호를 한곳에 모으며, GPT-6 Sol과 Claude Opus 5.5 같은 모델의 아레나 간 점수를 보여 줄 수 있다.
새 개요는 신규 추가 모델, 카테고리별 성능, 역량 메모, Arena 뉴스의 실시간 신호를 한곳에 모으며, GPT-6 Sol과 Claude Opus 5.5 같은 모델의 아레나 간 점수를 보여 줄 수 있다.
Arena.ai는 Code Arena WebDev에서 Claude Opus 5.5 (Max)를 1,818점으로 1위에 올렸다. GPT-6 Astra (Max)보다 26점, Opus 5 (Max)보다 126점 앞선다. Claude는 이 모델이 대부분 작업에서 Claude Fable 5.1 수준이며 실행 비용은 Opus 5보다 40% 낮다고 밝혔다.
Arena.ai는 SpaceXAI의 Grok 4.7 (xHigh)에 1,632점을 부여했으며, Grok 4.6 (High)보다 16점, 여섯 계단 높다. Simulations와 Consumer Product 순위도 올랐다.
다국어 Controlled Voice Arena 리더보드는 9개 신규 언어의 텍스트 음성 변환 모델을 비교한다. 언어를 선택할 수 있는 리더보드, 공개 투표 아레나, 벤치마킹 방법론을 이용할 수 있다.
Artificial Analysis 순위에서 아홉 개 언어를 모두 앞서는 단일 오픈 웨이트 텍스트 음성 변환 모델은 없다. Higgs Audio V3 TTS, OpenAudio S1 Mini, Voxtral TTS, Breeze TTS 2가 각각 다른 언어에서 오픈 웨이트 분야 1위이며, 각 순위판에는 오픈 웨이트 모델이 2~6개만 포함된다.
Controlled Voice Arena가 이제 일본어, 만다린 중국어, 힌디어, 스페인어, 독일어, 프랑스어, 포르투갈어, 베트남어, 아랍어로 텍스트 음성 변환 모델을 순위화한다. Cartesia의 Sonic 제품군이 9개 보드 중 8개에서 선두이고, Inworld AI의 Realtime TTS-2가 만다린 중국어에서 1위다.
Arena.ai 집계에서 Qwen-Image-2.1은 1,228점으로 오픈 모델 1위, 전체 17위다. Gemini-3-pro-image-preview보다 4점, GPT-Image-1.5-high-fidelity보다 11점 낮다.