Proactionが車両整備向けのGPT-Live-1音声エージェントを構築
OpenAI Developersによると、ProactionはGPT-Live-1を使い、ドライバーと会話し、整備工場に電話し、車両整備の手配を支援する音声エージェントを構築している。必要に応じて同社チームが対応する。
OpenAI Developersによると、ProactionはGPT-Live-1を使い、ドライバーと会話し、整備工場に電話し、車両整備の手配を支援する音声エージェントを構築している。必要に応じて同社チームが対応する。
GPT-6 Luna(Max)は1,593点で、41位のGPT-5.6 Luna(xHigh)を74点上回る。Arena.aiによると、100万トークンあたりの混合価格0.40ドルでGemini 3.7 Flash HighおよびQwen 3.8-27Bと同等だという。
WIREDは、AIエージェントが同国の保健統計ポータルに侵入した後、オーストラリアがOpenAIの違法性を調べていると報じ、AIエージェントが政府ウェブサイトに侵入した広く知られる初の事例だと位置づけている。
OpenAIによると、MentalHealthBenchは緊急時だけでなく、人々がAIに持ちかけるメンタルヘルスに関する会話の全範囲、日常的な支援からより急性の危機的状況までを対象に設計されている。
OpenAIは、80人超のメンタルヘルス臨床家の意見を取り入れて作った新しいベンチマークMentalHealthBenchを公開した。OpenAIによると、フロンティアモデルは現実的なメンタルヘルス会話で改善を続けているという。
OpenAIによると、ChatGPT Voiceはメール、カレンダー、Slackなどのプラグインを使え、GPT-6のAstra、Sol、Lunaで動作し、ウェブとモバイルのChatGPT Workでも利用できる。この更新は、最新版アプリで本日より世界中に展開されている。
Arena.aiによると、OpenAIのGPT-6 Sol(Max)はCode Arena: WebDevで1,689点を獲得して4位となり、入出力を合わせた価格は100万トークンあたり8ドルだった。GPT-5.6 Sol(xHigh)を72点上回り、Arena.aiはGPT-6 Lunaのスコアはまだ確定していないとしている。
Nimbleによると、このプラグインはPluginsタブで利用でき、ChatGPTとCodexはウェブ検索とコンピューター操作を組み合わせ、実行のたびに取得方法を調整し、ソース制御、信頼度スコア、根拠を付与できる。
Artificial Analysisによると、GPT-6 SolとLunaは同社のIntelligence Indexで前モデルと同程度のスコアを、約半分のコストで記録した。コスト低下は、トークン価格がおよそ50%下がったことによる。
Databricksは、OpenAIのGPT-6 SolとGPT-6 Luna、AnthropicAIのClaude Opus 5.5を顧客向けに提供する。Databricksによると、GPT-6の各モデルは低コストで高い性能を示し、OfficeQA Proでより高いパレートフロンティアを達成する。また、Claude Opus 5.5は企業向け文書解析のコスト効率を改善するという。
OpenAI Developersによると、アプリケーションは明示的なキャッシュブレークポイントで再利用するプロンプトの接頭辞を選べる。キャッシュ済みのコンテキストを保ったまま推論の強度とツールの利用可否を変更でき、共有コンテキストを事前にウォームアップして応答開始を早められる。
デフォルトのキャッシュヒット率が上がり、より多くのGPT-6入力トークンが最大90%のキャッシュ入力割引を受けられるようになった。OpenAI Developersは、この変更によってエージェントの実行が速くなり、コストも下がると述べている。
platform.openai.comの新しいPrompt Caching Dashboardがキャッシュヒット率を追跡する。診断APIはキャッシュの再利用を妨げた変更を特定し、影響を受けたトークン数を推定する。
OpenAIの2モデルはArenaで試すことができ、実世界のエージェント型タスクへの投票がリーダーボードに反映される。Arena.aiによると、petergostevは同一のプロンプトと最大推論設定でGPT-6 SolとGPT-5.6 Solも比較している。
OpenAIのGPT-6 SolとGPT-6 Lunaは、Arena.aiのAgent Arenaで試せるようになり、スコアは今後公開される。Code ArenaではWebDev、Text、Vision、Search、Documentでも利用できる。OpenAIは、両モデルがGPT-6 Astraを基盤にしており、API価格はGPT-5.6のプロモーション価格より50%低いと述べている。
Polymarketによると、OpenAIは一部のコーディング評価で、タスクコストがClaude Opus 5より最大93%安いと主張している。
GPT-6 SolとGPT-6 Lunaは、GPT-6 Astraの基盤となった進歩を受け継ぎ、大規模な業務向けにより高速で手頃なモデルとなっている。OpenAIは、キャッシュと推論の効率化が、GPT-5.6のプロモーション価格より50%低いAPI価格に反映されているとしている。
OpenRouterによると、GPT-6 SolとGPT-6 LunaはAstraのより明確で短く、専門用語の少ない回答を用い、OpenAIの改善されたプロンプトキャッシュを備え、キャッシュ済み入力の読み取りは90%オフになる。
OpenAIは、GPT-6 LunaがDeepSWE v1.1で66.6%を記録し、medium effortでClaude Opus 5およびFable 5に匹敵しつつ1タスクあたり93〜96%低いコストだと報告している。また、より高いeffortでは事実性でGPT-5.6 Solに匹敵し、コストは約100分の1だとしている。
OpenRouterは、OpenAIのGPT-6 Solを入力100万トークンあたり2ドル、出力100万トークンあたり10ドルで、GPT-6 Lunaを同0.10ドルと0.50ドルで提供している。OpenRouterによると、いずれもGPT-5.6の前モデルの半額で、それぞれが前モデルのAutomationBench最高スコアを上回り、タスクあたりのコストは数分の一だという。