# GitHub、AIコードレビュアーを評価するオープンベンチマーク「ReviewBench」を公開

GitHubは、AIコードレビューエージェントが不要なノイズを出さずに重要な問題を特定できるかを評価するオープンベンチマーク「ReviewBench」を公開した。19言語にわたる219件のプルリクエストに基づいている。

Language: ja
Time zone: Asia/Tokyo

HTML: https://didcodexreset.com/ja/news/346c3e7d47fa4159b799704c.html

Content language: ja
Localization state: translated

出典：GitHub · 2026/10/7 03:58:00 公開

GitHubは、AIコードレビュアーが余計なノイズを増やすことなく重要な問題を捉えられるかを検証するオープンベンチマーク「ReviewBench」を公開した。このベンチマークはGitHub上の1億390万件のプルリクエスト分析から導出され、19のプログラミング言語にわたる219件のプルリクエストで構成されている。

[GitHubのブログ記事](https://github.blog/ai-and-ml/github-copilot/reviewbench-an-open-benchmark-for-ai-code-review/?utm_source=x-promoting-reviewbench-blog-article&utm_medium=social&utm_campaign=reviewbenchmark-oct-2026)にある通り、開発者は独自のコードレビューエージェントを持ち込んでベンチマークで評価し、結果を提出できる。

Tags: GitHub, ReviewBench, AIコードレビュー, ベンチマーク

[元の投稿を見る](https://x.com/github/status/2107540144949473754)
