# GitHub, AI 코드 리뷰어 평가를 위한 오픈 벤치마크 ReviewBench 출시

GitHub가 AI 코드 리뷰 에이전트가 노이즈 없이 핵심 문제를 식별하는지 평가하기 위한 오픈 벤치마크 ReviewBench를 출시했다. 19개 언어에 걸친 219개 풀 리퀘스트를 기반으로 한다.

Language: ko
Time zone: Asia/Seoul

HTML: https://didcodexreset.com/ko/news/346c3e7d47fa4159b799704c.html

Content language: ko
Localization state: translated

출처: GitHub · 2026. 10. 7. 03:58:00 게시

GitHub는 AI 코드 리뷰어가 불필요한 노이즈를 더하지 않고 유의미한 문제를 잡아내는지 테스트하기 위한 오픈 벤치마크 ReviewBench를 출시했다. 이 벤치마크는 GitHub 풀 리퀘스트 1억 390만 건을 분석해 구축되었으며, 19개 프로그래밍 언어의 풀 리퀘스트 219건을 모았다.

[GitHub 블로그 게시물](https://github.blog/ai-and-ml/github-copilot/reviewbench-an-open-benchmark-for-ai-code-review/?utm_source=x-promoting-reviewbench-blog-article&utm_medium=social&utm_campaign=reviewbenchmark-oct-2026)에 상세히 소개된 것처럼, 개발자는 자체 코드 리뷰 에이전트를 적용해 벤치마크로 평가하고 결과를 제출할 수 있다.

Tags: GitHub, ReviewBench, AI 코드 리뷰, 벤치마크

[원문 게시물 보기](https://x.com/github/status/2107540144949473754)
