Mistral AI、Mistral Large 4 が Harvey の Legal Agent Benchmark でオープンソースモデル首位と発表
Mistral AI は、Mistral Large 4 が Harvey の Legal Agent Benchmark でオープンソースモデル首位になったと発表した。
Mistral AI は、Mistral Large 4 が Harvey の Legal Agent Benchmark でオープンソースモデル首位になったと発表した。
Mistral AIはAutomationBenchの評価結果を公開した。Mistral Large 4は模擬職場アプリケーションにおける657件の業務ワークフローを完了し、Kimi K3、MiMo-V2.6-Pro、DeepSeek V4 Proを上回る結果となった。
Mistral Large 4が1,534スコアを獲得してArena.aiのCode Arena: WebDevリーダーボードで45位に入り、Claude Opus 4.8 (High)と2スコア差以内の性能を約6分の1の混合トークンコストで達成しました。
OpenCodeがプラットフォーム上でMistral Large 4の提供を開始し、今後2週間にわたり同モデルを50%引きで提供します。
ClineはコマンドラインインターフェースおよびデスクトップアプリでMistral Large 4のサポートを追加した。同チームによると、本モデルにより、GPTやClaudeモデルでは制限されていたり利用できなかったりしたセキュリティ重視のワークフローが可能になるという。
Command Codeは全プランおよびAPIでMistral Large 4の提供を開始しました。総パラメータ数は1兆、アクティブパラメータ数は490億で、524Kのコンテキストウィンドウを備えています。
Mistral AI は、Mistral Large 4 が実環境での実行に基づくツール呼び出しを用い、Capture the Flag(CTF)スピードランで 19 問中 18 問の課題を解決したと報告した。
Surge AIはMistral Large 4のリリースにあたり、先端5モデルのコードレビュー品質を評価した。同モデルはオープンウェイトモデルの中で首位、総合ではOpus 5に次ぐ2位となった。
Arena.ai は、Mistral AI の Mistral Large 4 を Agent Arena でのユーザーテスト向けに追加し、WebDev、Text、Vision にわたる Code Arena でも提供を開始した。本モデルは総パラメータ数1兆、アクティブパラメータ数490億で、評価スコアは近日中に公開される予定。
Artificial AnalysisがMistral Large 4 Previewの評価結果を公開した。同モデルはIntelligence Indexで38、Cyber Indexで50%を記録した。Mistral AIは512kコンテキスト対応の本モデルを、入力100万トークンあたり1.36ドル、出力100万トークンあたり4.18ドルで提供しており、提供開始から最初の2週間は50%割引が適用される。
Mistral AIは、総パラメータ数1兆、アクティブパラメータ数490億のネイティブマルチモーダルモデル「Mistral Large 4」を発表した。10月下旬に予定されているオープンウェイト公開に先立ち、現在はAPIおよびMistral Cloudインフラを通じて利用できる。