OpenRouterのツール検索は、大規模な関数ライブラリをプロンプトから外す
defer_loadingとマークされた関数は、モデルが必要になったときに検索され、ターンごとにすべての定義が送られることはない。OpenRouterは、ツール検索に追加料金はないとしている。
defer_loadingとマークされた関数は、モデルが必要になったときに検索され、ターンごとにすべての定義が送られることはない。OpenRouterは、ツール検索に追加料金はないとしている。
OpenRouterのServer Tools Marketplaceには、Advisor、Subagent、Web fetch、Image generation、Apply patch、Datetimeも含まれる。大半はリクエスト中にサーバー側で動作し、クライアント側のツールループは使わない。
OpenRouterは、エージェントをグラウンディングするためのツールとして、ウェブ検索API、Shell、ツール検索を含むServer Tools Marketplaceを導入した。
OpenRouterはAlibaba_QwenのQwen3.8 Max Primeを提供し、Qwen3.8 Maxと同じ2.4Tパラメータの能力を持つ高スループット版と説明している。
OpenRouterによると、Space Bunny Alphaを停止させていた問題は解決し、モデルの提供が再開された。
OpenRouterはRecraft V4.1 Flashを、画像1枚あたり0.007ドル、生成時間1.3秒で掲載している。写真、ポートレート、複雑なシーン、ロゴ、初期コンセプトでも、出力は依然としてRecraftらしい見た目だとしている。
Microsoft AIは、MAI-Image-2.6をFoundryとOpenRouterで試せるとしている。
OpenRouterは、提供元が問題への対応を進めている間、Space Bunny Alphaを取り下げた。モデルは安定し次第、復帰すると述べている。
OpenRouterによると、ステルスモデルのSpace Bunny Alphaは無料だ。今回は、提供元がプロンプトや補完を学習に使わない。
OpenRouterはSpace Bunny Alphaを、高速な推論と調整可能な推論を備えたフラッシュモデルと説明している。テキスト、画像、動画の入力に対応する。
OpenRouterはBatch APIのリクエストを最安のプロバイダーへ振り向け、呼び出し側は全モデルで/chat/completions、/responses、/messagesを使えると述べている。ファイルAPIなしでリクエストをポーリングして完全な応答を取得でき、持ち込みキーにも対応する。
OpenRouterによると、GPT-6 SolとGPT-6 LunaはAstraのより明確で短く、専門用語の少ない回答を用い、OpenAIの改善されたプロンプトキャッシュを備え、キャッシュ済み入力の読み取りは90%オフになる。
OpenAIは、GPT-6 LunaがDeepSWE v1.1で66.6%を記録し、medium effortでClaude Opus 5およびFable 5に匹敵しつつ1タスクあたり93〜96%低いコストだと報告している。また、より高いeffortでは事実性でGPT-5.6 Solに匹敵し、コストは約100分の1だとしている。
OpenRouterは、OpenAIのGPT-6 Solを入力100万トークンあたり2ドル、出力100万トークンあたり10ドルで、GPT-6 Lunaを同0.10ドルと0.50ドルで提供している。OpenRouterによると、いずれもGPT-5.6の前モデルの半額で、それぞれが前モデルのAutomationBench最高スコアを上回り、タスクあたりのコストは数分の一だという。
OpenRouterは、Opus 5から移行する開発者向けにこの3つの違いを挙げており、移行ガイドでは変更点とプロンプトの更新方法を説明している。
OpenRouterは、AnthropicAIのClaude Opus 5.5を100万トークンのコンテキストウィンドウ付きで提供している。料金は入力100万トークンあたり4ドル、出力100万トークンあたり20ドルで、OpenRouterによるとトークンあたりOpus 5より20%低い。
各バッチはOpenRouterログのBatchesタブに表示され、モデル、プロバイダー、ステータス、コストが示される。入力と結果は30日間、またはバッチが削除されるまで保持される。
画像とファイルはbase64ではなく公開URLである必要がある。音声と動画の入力は受け付けず、OpenRouter独自のウェブプラグインはバッチでは利用できない。
OpenRouterのBatch APIは、即時の回答を必要としない処理向けに利用できる。大半のモデルでトークン単価を半額にし、結果は24時間以内に返される。
OpenRouter ClassifiersではtypesafeaiのJevを使ってLLMリクエストを自動分類でき、結果はExploreで分析できる。