GPT-6 SolとGPT-6 LunaをBattle ModeとAgent Modeで試せる
GPT-6 SolとGPT-6 Lunaは、Arena.aiのBattle ModeとAgent Modeで試せる。
GPT-6 SolとGPT-6 Lunaは、Arena.aiのBattle ModeとAgent Modeで試せる。
新しい概要ページは、新たに追加されたモデル、カテゴリー別の成績、能力に関する所見、Arenaのニュースといったライブの指標をまとめ、GPT-6 SolやClaude Opus 5.5などのモデルについてアリーナ横断のスコアを表示できる。
米国内の大学のテニュアトラック教員は、AI評価の科学的基盤をテーマに2026年秋の提案を提出できる。各プロジェクトは最大5万ドルを受け取れる可能性があり、締切は2026年10月30日。
Arena.aiは、AnthropicのClaude Opus 5.5とOpenAIのGPT-6 Solについて並べた出力を生成したと述べ、Claude Opus 5.5のスコアは近日公開予定だとしている。
Arena.aiによると、OpenAIのGPT-6 Sol(Max)はCode Arena: WebDevで1,689点を獲得して4位となり、入出力を合わせた価格は100万トークンあたり8ドルだった。GPT-5.6 Sol(xHigh)を72点上回り、Arena.aiはGPT-6 Lunaのスコアはまだ確定していないとしている。
OpenAIの2モデルはArenaで試すことができ、実世界のエージェント型タスクへの投票がリーダーボードに反映される。Arena.aiによると、petergostevは同一のプロンプトと最大推論設定でGPT-6 SolとGPT-5.6 Solも比較している。