Mistral AI 稱 Mistral Large 4 在 Harvey 法律智能體基準測試中位居開源模型首位
Mistral AI 表示,Mistral Large 4 在 Harvey 的法律智能體基準測試(Legal Agent Benchmark)中名列開源模型第一。
Mistral AI 表示,Mistral Large 4 在 Harvey 的法律智能體基準測試(Legal Agent Benchmark)中名列開源模型第一。
Mistral AI 公布了 AutomationBench 評測結果。在模擬辦公應用的 657 項業務工作流程中,Mistral Large 4 完成了測試,表現領先於 Kimi K3、MiMo-V2.6-Pro 和 DeepSeek V4 Pro。
Mistral Large 4 以 1,534 分登陸 Arena.ai 的 Code Arena: WebDev 榜單第 45 位,與 Claude Opus 4.8 (High) 差距僅 2 分,混合 Token 成本約為後者的六分之一。
OpenCode 已在其平台上架 Mistral Large 4,並在未來兩週為該模型提供五折優惠。
Cline 報告指出,Mistral Large 4 在網絡安全基準測試中表現優於 Opus 5.5 與 GPT-6 Astra,主因是競爭模型有約 40% 的任務遭安全過濾器攔截。
Cline 已在其命令行介面與桌面應用加入對 Mistral Large 4 的支援。團隊表示,該模型可用於以往使用 GPT 或 Claude 模型時受阻或無法進行的安全相關工作流程。
Command Code 已於所有服務方案及其 API 推出 Mistral Large 4。該模型擁有 1 萬億總參數、490 億啟用參數,以及 524K 上下文窗口。
Mistral AI 示範了 Mistral Large 4 端對端分析未知二進制檔案。該模型在 12 分鐘內將樣本識別為 Cobalt Strike,提取了威脅指標(IoC)與惡意軟件配置,並生成包含 YARA 規則的報告。
Mistral AI 表示,Mistral Large 4 在基於實際運行環境的奪旗賽(CTF)競速測試中透過工具調用攻破了 19 項挑戰中的 18 項。
Surge AI 配合 Mistral Large 4 發布評估了五款前沿模型的代碼審查質素,該模型在開放權重模型中排名第一,總榜僅次於 Opus 5 位列第二。
Mistral Large 4 現已於 OpenRouter 開放公開預覽,具備 100 萬 Token 上下文窗口,快取輸入定價為每百萬 Token 0.07 美元。首兩週內設有半價優惠,輸入價格為每百萬 Token 0.68 美元,輸出價格為每百萬 Token 2.09 美元。
Arena.ai 已將 Mistral AI 的 Mistral Large 4 加入 Agent Arena 供用戶測試,並同步登陸涵蓋 WebDev、Text 及 Vision 的 Code Arena。該模型總參數達 1 萬億,活躍參數為 490 億,評測分數即將公佈。
Mistral Large 4 現已在 OpenRouter 開放公開預覽,具備 512K 上下文窗口及最高 256K 輸出 Token。OpenRouter 於首兩周提供五折優惠,輸入每百萬 Token 為 0.68 美元,輸出每百萬 Token 為 2.09 美元。
Victor M 表示 Mistral 4 即將登陸 Hugging Face,並附上了 Mistral-Large-4.0-1T05-A52B 模型頁面連結。該消息未提及發布日期,亦未表明模型權重目前可用。
Mistral AI 發布原生多模態模型 Mistral Large 4,總參數達 1 萬億,激活參數為 490 億。該模型現已透過 API 及 Mistral Cloud 基礎設施提供,並計劃於 10 月底開放模型權重。