Mistral AI 稱 Mistral Large 4 在 Harvey 法律智能體基準測試中位居開源模型首位
Mistral AI 表示,Mistral Large 4 在 Harvey 的法律智能體基準測試(Legal Agent Benchmark)中名列開源模型第一。
Mistral AI 表示,Mistral Large 4 在 Harvey 的法律智能體基準測試(Legal Agent Benchmark)中名列開源模型第一。
Mistral AI 公布了 AutomationBench 評測結果。在模擬辦公應用的 657 項業務工作流程中,Mistral Large 4 完成了測試,表現領先於 Kimi K3、MiMo-V2.6-Pro 和 DeepSeek V4 Pro。
Mistral Large 4 以 1,534 分登陸 Arena.ai 的 Code Arena: WebDev 榜單第 45 位,與 Claude Opus 4.8 (High) 差距僅 2 分,混合 Token 成本約為後者的六分之一。
OpenCode 已在其平台上架 Mistral Large 4,並在未來兩週為該模型提供五折優惠。
Cline 已在其命令行介面與桌面應用加入對 Mistral Large 4 的支援。團隊表示,該模型可用於以往使用 GPT 或 Claude 模型時受阻或無法進行的安全相關工作流程。
Command Code 已於所有服務方案及其 API 推出 Mistral Large 4。該模型擁有 1 萬億總參數、490 億啟用參數,以及 524K 上下文窗口。
Mistral AI 表示,Mistral Large 4 在基於實際運行環境的奪旗賽(CTF)競速測試中透過工具調用攻破了 19 項挑戰中的 18 項。
Surge AI 配合 Mistral Large 4 發布評估了五款前沿模型的代碼審查質素,該模型在開放權重模型中排名第一,總榜僅次於 Opus 5 位列第二。
Arena.ai 已將 Mistral AI 的 Mistral Large 4 加入 Agent Arena 供用戶測試,並同步登陸涵蓋 WebDev、Text 及 Vision 的 Code Arena。該模型總參數達 1 萬億,活躍參數為 490 億,評測分數即將公佈。
Artificial Analysis 評測了 Mistral Large 4 Preview,該模型在 Intelligence Index 得分為 38,在 Cyber Index 為 50%。Mistral AI 為這款 512k 上下文模型定價為每 100 萬輸入 token 1.36 美元、每 100 萬輸出 token 4.18 美元,首兩週提供半價優惠。
Mistral AI 發布原生多模態模型 Mistral Large 4,總參數達 1 萬億,激活參數為 490 億。該模型現已透過 API 及 Mistral Cloud 基礎設施提供,並計劃於 10 月底開放模型權重。