# GitHub 推出開源基準 ReviewBench，用於評估 AI 代碼審查工具

GitHub 發布開源基準 ReviewBench，旨在評估 AI 代碼審查 Agent 能否在不產生雜訊的情況下識別關鍵問題。該基準基於涵蓋 19 種語言的 219 個 Pull Request。

Language: zh-HK
Time zone: Asia/Hong_Kong

HTML: https://didcodexreset.com/zh-hk/news/346c3e7d47fa4159b799704c.html

Content language: zh-HK
Localization state: translated

來源：GitHub · 發布於 7/10/2026 02:58:00

GitHub 推出開源基準 ReviewBench，用於測試 AI 代碼審查工具能否在不增加雜訊的情況下發現實質問題。該基準源於對 GitHub 上 1.039 億個 Pull Request 的分析，匯集了涵蓋 19 種編程語言的 219 個 Pull Request。

如 [GitHub 的網誌文章](https://github.blog/ai-and-ml/github-copilot/reviewbench-an-open-benchmark-for-ai-code-review/?utm_source=x-promoting-reviewbench-blog-article&utm_medium=social&utm_campaign=reviewbenchmark-oct-2026) 所述，開發者可以自攜代碼審查 Agent，利用該基準進行評估並提交結果。

Tags: GitHub, ReviewBench, AI 代碼審查, 基準測試

[查看主帖原文](https://x.com/github/status/2107540144949473754)
