# GitHub 推出开源基准 ReviewBench，用于评估 AI 代码审查工具

GitHub 发布了开源基准 ReviewBench。该基准基于覆盖 19 种语言的 219 个拉取请求，旨在评估 AI 代码审查智能体能否在不增加杂讯的前提下识别关键问题。

Language: zh-CN
Time zone: Asia/Shanghai

HTML: https://didcodexreset.com/zh/news/346c3e7d47fa4159b799704c.html

Content language: zh-CN
Localization state: translated

来源：GitHub · 发布于 2026/10/7 02:58:00

GitHub 推出开源基准 ReviewBench，用于测试 AI 代码审查工具能否在不产生多余噪音的情况下捕获实质问题。该基准源自对 GitHub 上 1.039 亿个拉取请求的分析，并整合了涵盖 19 种编程语言的 219 个拉取请求。

如 [GitHub 官方博文](https://github.blog/ai-and-ml/github-copilot/reviewbench-an-open-benchmark-for-ai-code-review/?utm_source=x-promoting-reviewbench-blog-article&utm_medium=social&utm_campaign=reviewbenchmark-oct-2026) 所述，开发者可以接入自己的代码审查智能体，通过该基准进行评估并提交结果。

Tags: GitHub, ReviewBench, AI 代码审查, 基准测试

[查看主帖原文](https://x.com/github/status/2107540144949473754)
