Mistral AI, Mistral Large 4가 Harvey 법률 에이전트 벤치마크서 오픈소스 모델 1위 차지했다고 밝혀
Mistral AI는 Mistral Large 4가 Harvey의 Legal Agent Benchmark에서 오픈소스 모델 1위를 기록했다고 밝혔다.
Mistral AI는 Mistral Large 4가 Harvey의 Legal Agent Benchmark에서 오픈소스 모델 1위를 기록했다고 밝혔다.
Mistral AI가 AutomationBench 평가 결과를 발표했다. Mistral Large 4는 시뮬레이션된 업무용 애플리케이션 환경에서 657개 비즈니스 워크플로를 완료하며 Kimi K3, MiMo-V2.6-Pro, DeepSeek V4 Pro를 앞섰다.
Mistral Large 4가 1,534점으로 Arena.ai의 Code Arena: WebDev 리더보드 45위에 올랐으며, Claude Opus 4.8 (High)와 2점 차이를 기록하면서 혼합 토큰 비용은 약 6분의 1 수준을 유지했습니다.
OpenCode가 플랫폼에 Mistral Large 4를 도입하고 향후 2주 동안 해당 모델에 50% 할인을 제공합니다.
Cline이 명령줄 인터페이스와 데스크톱 애플리케이션에 Mistral Large 4 지원을 추가했다. 개발팀은 이 모델을 통해 기존에 GPT나 Claude 모델 사용 시 차단되었거나 지원되지 않던 보안 중심 워크플로를 수행할 수 있다고 밝혔다.
Command Code가 모든 요금제와 API에 Mistral Large 4를 출시했습니다. 총 매개변수 1조 개, 활성 매개변수 490억 개, 524K 컨텍스트 창을 지원합니다.
Mistral AI는 Mistral Large 4가 실제 실행 환경 기반의 도구 호출을 사용해 CTF(Capture the Flag) 스피드런에서 19개 과제 중 18개를 해결했다고 밝혔다.
Surge AI가 Mistral Large 4 출시에 맞춰 프론티어 모델 5종의 코드 리뷰 품질을 평가한 결과, 해당 모델이 오픈 웨이트 모델 중 1위, 종합 순위에서는 Opus 5에 이어 2위를 차지했다.
Arena.ai가 사용자 테스트를 위해 Mistral AI의 Mistral Large 4를 Agent Arena에 추가했으며, WebDev, Text, Vision 전반의 Code Arena에도 함께 도입했다. 이 모델은 총 1조 개의 매개변수와 490억 개의 활성 매개변수를 갖추고 있으며, 평가 점수는 곧 공개될 예정이다.
Artificial Analysis가 Mistral Large 4 Preview를 평가했다. 해당 모델은 Intelligence Index에서 38점, Cyber Index에서 50%를 기록했다. Mistral AI는 512k 컨텍스트를 지원하는 이 모델을 100만 입력 토큰당 1.36달러, 100만 출력 토큰당 4.18달러에 제공하며, 출시 후 첫 2주 동안 50% 할인 혜택을 적용한다.
Mistral AI가 총 매개변수 1조 개, 활성 매개변수 490억 개 규모의 네이티브 멀티모달 모델 Mistral Large 4를 발표했다. 10월 말 오픈 가중치 공개에 앞서 현재 API와 Mistral Cloud 인프라를 통해 즉시 이용할 수 있다.