Did Codex Reset
GitHub

AIニュース

StepFun Step 5 Preview、Artificial Analysis Intelligence Indexで44、タスクあたり$0.71

StepFunは、Step 5 PreviewがIntelligence Indexで44、タスクあたり$0.71となったArtificial Analysisの結果を強調し、10月15日にさらに発表があるとした。評価では、ファーストパーティAPIアクセスを備え、10月15日にオープンウェイトを予定する600B/27B MoEフラッグシップと説明されている。

TypeSafe、MotherDuckのprompt_jev()をテキスト分類で約50倍高速・約100倍安価と強調

TypeSafeは、TypeSafeのJevモデルを搭載したSQL関数prompt_jev()によりテキスト分類が約50倍高速でコスト約1%になったというMotherDuckの主張を引用した。MotherDuckは、LLMでは32分・37ドルかかるのに対し、100k行を40秒・0.50ドルで処理したと報告した。

Question's Gambit、ディープリサーチエージェントの最初の検索手順を変える

この一度きりの手法は、質問を手がかりに分け、相補的な検索を実行し、エージェントのループが始まる前に集約した結果を再ランク付けする。BrowseComp-Plusでは、同じ検索器とエージェントループを用いた場合、GPT-5.5の精度は83.1%から90.5%に上がる。

Googleが2つの新しいDeepMind音声モデルを紹介:Gemini 3.8 LiveとGemini 3.8 Live Extended Thinking

Googleは先週、Google DeepMindの2つの新しい音声モデル、Gemini 3.8 LiveとGemini 3.8 Live Extended Thinkingを導入したと述べ、チームメンバーがクリエイティブなアプリケーション、リアルタイムサポート、ロボティクスにわたってそれらを使って構築していると述べた。