Arena.ai, 개편된 Leaderboard Overview 출시
새 개요는 신규 추가 모델, 카테고리별 성능, 역량 메모, Arena 뉴스의 실시간 신호를 한곳에 모으며, GPT-6 Sol과 Claude Opus 5.5 같은 모델의 아레나 간 점수를 보여 줄 수 있다.
새 개요는 신규 추가 모델, 카테고리별 성능, 역량 메모, Arena 뉴스의 실시간 신호를 한곳에 모으며, GPT-6 Sol과 Claude Opus 5.5 같은 모델의 아레나 간 점수를 보여 줄 수 있다.
미국 대학의 정년 트랙 교원은 AI 평가의 과학적 기반을 주제로 2026년 가을 제안서를 제출할 수 있다. 각 프로젝트는 최대 5만 달러를 받을 수 있으며, 마감일은 2026년 10월 30일이다.
Arena.ai는 Anthropic의 Claude Opus 5.5와 OpenAI의 GPT-6 Sol로 나란히 비교한 출력을 생성했으며, Claude Opus 5.5의 점수는 곧 공개될 예정이라고 밝혔다.
Arena.ai는 OpenAI의 GPT-6 Sol (Max)가 Code Arena: WebDev에서 1,689점을 받아 4위에 올랐으며, 입력과 출력을 합산한 가격은 토큰 100만 개당 8달러라고 전했다. GPT-5.6 Sol (xHigh)보다 72점 높고, Arena.ai는 GPT-6 Luna의 점수가 아직 집계 중이라고 밝혔다.
Arena.ai에서 두 모델 모두 Battle Mode와 Agent Mode를 써볼 수 있다.
Arena.ai가 Claude Opus 5.5를 Agent Arena와 WebDev, Text, Vision, Document용 Battle Mode에 추가했다. Claude는 이 모델이 Claude 5.5 제품군의 첫 모델이며, 대부분의 작업에서 Claude Fable 5.1 수준으로 동작하고 Opus 5보다 실행 비용이 40% 낮다고 밝혔다.