JEVのカスケードは料金の約57%でGPT-6の精度の99%を維持
Jev-as-a-Judgeの論文は、TypeSafe AIのJEVが確信を持って出した判定を採用し、残りをGPT-6 Astraへエスカレーションすると、510件のホールドアウト選好ペアでGPT-6の精度の99%を、GPT-6の料金の約57%で維持したと報告している。著者らは、エスカレーションの閾値はすべてのフォールバックモデルへそのまま移せず、自らのデータで設定すべきだとしている。
Jev-as-a-Judgeの論文は、TypeSafe AIのJEVが確信を持って出した判定を採用し、残りをGPT-6 Astraへエスカレーションすると、510件のホールドアウト選好ペアでGPT-6の精度の99%を、GPT-6の料金の約57%で維持したと報告している。著者らは、エスカレーションの閾値はすべてのフォールバックモデルへそのまま移せず、自らのデータで設定すべきだとしている。
OpenAIによると、ChatGPT Voiceはメール、カレンダー、Slackなどのプラグインを使え、GPT-6のAstra、Sol、Lunaで動作し、ウェブとモバイルのChatGPT Workでも利用できる。この更新は、最新版アプリで本日より世界中に展開されている。
Codex CLI 0.156.1は、モデルピッカーにGPT-6 SolとGPT-6 Lunaを含む。レート制限の切り替えではGPT-6 Lunaが提案され、モデルカタログも更新された。
Artificial Analysisによると、GPT-6 SolとLunaは同社のIntelligence Indexで前モデルと同程度のスコアを、約半分のコストで記録した。コスト低下は、トークン価格がおよそ50%下がったことによる。
Gleanは、自社評価においてClaude Opus 5.5が前モデルと比べトークンコストを50%削減するとし、GPT-6 LunaとGPT-6 Solはいずれも前モデルより50%安いとしている。
LunaはすべてのプランとAPIで利用できる。10ドルのGOATプランは一例として示され、リクエスト数は約3万、トークン数は約15億である。SolはProとMaxのプランおよびAPIで利用できる。
Databricksは、OpenAIのGPT-6 SolとGPT-6 Luna、AnthropicAIのClaude Opus 5.5を顧客向けに提供する。Databricksによると、GPT-6の各モデルは低コストで高い性能を示し、OfficeQA Proでより高いパレートフロンティアを達成する。また、Claude Opus 5.5は企業向け文書解析のコスト効率を改善するという。
OpenAI Developersによると、アプリケーションは明示的なキャッシュブレークポイントで再利用するプロンプトの接頭辞を選べる。キャッシュ済みのコンテキストを保ったまま推論の強度とツールの利用可否を変更でき、共有コンテキストを事前にウォームアップして応答開始を早められる。
デフォルトのキャッシュヒット率が上がり、より多くのGPT-6入力トークンが最大90%のキャッシュ入力割引を受けられるようになった。OpenAI Developersは、この変更によってエージェントの実行が速くなり、コストも下がると述べている。
OpenAIの2モデルはArenaで試すことができ、実世界のエージェント型タスクへの投票がリーダーボードに反映される。Arena.aiによると、petergostevは同一のプロンプトと最大推論設定でGPT-6 SolとGPT-5.6 Solも比較している。
Arena.aiでは、両モデルをBattle ModeとAgent Modeで試せる。
OpenAIのGPT-6 SolとGPT-6 Lunaは、Arena.aiのAgent Arenaで試せるようになり、スコアは今後公開される。Code ArenaではWebDev、Text、Vision、Search、Documentでも利用できる。OpenAIは、両モデルがGPT-6 Astraを基盤にしており、API価格はGPT-5.6のプロモーション価格より50%低いと述べている。
GitHub Copilotは、OpenAIDevsのGPT-6ファミリーから2つの追加モデルを一般提供する。対話型およびエージェント型のコーディング向けのGPT-6 Solと、GitHubが小規模なタスク向けの軽量かつ最安の選択肢と呼ぶGPT-6 Lunaである。
Sam Altman氏は、GPT-6 SolとLunaが知能、アライメント、作業成果、コーディング、コンピュータ利用の点で5.6ファミリーの前モデルから大きく向上し、トークンあたりの価格は半分、タスクあたりではさらに安いと述べている。タスクあたりの価格では、市場に競争力のあるものは見当たらないと考えているという。
Polymarketによると、OpenAIは一部のコーディング評価で、タスクコストがClaude Opus 5より最大93%安いと主張している。
同氏によると、両モデルは知能、アライメント、作業成果、コーディング、コンピュータ利用の点で5.6系列の前モデルから大きく向上しており、タスクあたりのコストはさらに低いという。
GPT-6 SolとGPT-6 Lunaは、GPT-6 Astraの基盤となった進歩を受け継ぎ、大規模な業務向けにより高速で手頃なモデルとなっている。OpenAIは、キャッシュと推論の効率化が、GPT-5.6のプロモーション価格より50%低いAPI価格に反映されているとしている。
OpenRouterによると、GPT-6 SolとGPT-6 LunaはAstraのより明確で短く、専門用語の少ない回答を用い、OpenAIの改善されたプロンプトキャッシュを備え、キャッシュ済み入力の読み取りは90%オフになる。
OpenRouterは、OpenAIのGPT-6 Solを入力100万トークンあたり2ドル、出力100万トークンあたり10ドルで、GPT-6 Lunaを同0.10ドルと0.50ドルで提供している。OpenRouterによると、いずれもGPT-5.6の前モデルの半額で、それぞれが前モデルのAutomationBench最高スコアを上回り、タスクあたりのコストは数分の一だという。
2026年9月22日の提供開始は、Plus、Pro、Business、Enterprise、Eduの各ユーザーを対象とする。