Did Codex Reset
GitHub

AIニュース

SkillLift論文、エージェントスキル進化のトークンコスト40~70%削減を報告

DAIR.AIは、フルロールアウトですべての改訂を採点する代わりに、学習したルーブリックを訓練してエージェントのスキルプロンプト候補をランク付けするSkillLift論文を取り上げた。SkillsBenchおよびWildClawBenchでSkillOptとCoEvoSkillsを上回り、40~70%少ないトークン数で目標性能に達したと報告している。

Command Code、約4万件の偽$1 Goアカウントを禁止、非公式プロキシに警告

Command Codeは先週、同社の$1 Goプランで約40,000件の偽アカウントを作成し、約$450,000の推論を押し通そうとした詐欺グループを摘発したと述べた。同社はアカウントを禁止・報告し、プロキシを遮断し、非公式のリバースエンジニアリングされたプロキシを使用しないようユーザーに警告し、Pi向けのCommand Codeプロバイダーが本日開始すると述べた。

Peter Steinberger:MetaはOpenClawに着想を得て独自のエージェントを構築

Peter Steinbergerは流布している「MetaがOpenClawを使用している」という話に反論するためNat Friedmanを引用し、彼らは独自のエージェントを構築し、OpenClawに着想を得たと述べた。Friedmanは、Museはゼロから構築されたが、OpenClawに強く着想を得ていると述べた。

Lambda、EGInterpolatorがDRUGSで分子動力学のギャップを縮小したと報告

Lambdaは、EGInterpolatorをStanfordとのICLR 2026の研究として説明し、豊富なコンフォーマーデータから分子構造を学習してから、乏しいMD軌跡から運動を学習するとした。DRUGSベンチマークでは、この手法が参照シミュレーションとのギャップを結合角で73%、結合長で78%、ねじれ運動で24%縮小したと述べた。

EvoOntology論文、自己進化するオントロジー層がDDR-BenchとBIRDでデータエージェントのスコアを向上と報告

elvis(@omarsar0)が、MCPサーバーとして提供されるデータエージェント向け自己進化オントロジー層EvoOntologyに関する論文を共有した。投稿によると、DDR-Benchの精度は6つのバックボーンで平均17.8ポイント上昇し、GPT-5.5では26.7ポイント、BIRDの実行精度は7.4ポイント上昇するという。

LangChain、マネージドディープエージェントのモデルルーティング向けTypesafe Jevミドルウェアを紹介

LangChainはnathan dreznerを引用し、Typesafe AIのJevミドルウェアの公式ドキュメントをリンクした。このミドルウェアは、ユーザーがルートを定義した後、LangChainのマネージドディープエージェントのモデル選択を処理できる。

AutoTailorが自動生成Web APIを1,283件の候補から33件に絞り込む

DAIR.AIは、Microsoft Researchとその同僚による論文AutoTailorを取り上げた。この論文はWeb軌跡をパラメータ化されたブラウザ自動化APIに変換し、それらを33件に絞り込む。106件のWebArena Postmillタスクにおいて、これらのAPIとReActフォールバックの組み合わせは90.6%の正確性に達し、ReAct単独の87.5%を上回った。

ChatGPTが米国のPlusおよびProユーザー向けにExperianクレジットスコア追跡を追加

ChatGPTは、ユーザーがExperianのクレジットレポートとVantageScore 3.0を安全に接続することでクレジットスコアを追跡できるようになったと述べました。この機能は、米国のPlusおよびProユーザー向けのFinancesで、ウェブおよび最新のiOSとAndroidアプリで利用可能です。