Woher wissen Sie, ob ein KI-Code-Reviewer die wichtigen Probleme erkennt, ohne zusätzliches Rauschen zu erzeugen?
ReviewBench ist ein neuer offener Benchmark, der auf der Analyse von 103,9M GitHub-Pull-Requests basiert, mit 219 PRs in 19 Sprachen.
Bringen Sie Ihren eigenen Code-Review-Agenten mit, evaluieren Sie ihn und reichen Sie Ihre Ergebnisse ein ⬇️
Weitere Informationen finden Sie unter https://github.blog/ai-and-ml/github-copilot/reviewbench-an-open-benchmark-for-ai-code-review/?utm_source=x-promoting-reviewbench-blog-article&utm_medium=social&utm_campaign=reviewbenchmark-oct-2026