Breaking News · Actualités
GitHub lance ReviewBench : les réviseurs IA seront comparés selon les défauts détectés
Le 5 octobre, GitHub a présenté ReviewBench, un aperçu de recherche d’un benchmark pour les agents de revue de code. Ses métriques distinguent les problèmes détectés, les omissions et le bruit superflu ; les résultats du test A/B interne de l’entreprise décrivent une expérience particulière, et non un classement général des modèles.