Créer un classificateur de base de code avec Jev
Un développeur partage la création d'un classificateur de base de code avec Jev, suggérant qu'il peut résoudre le code surconçu des agents, et demande quoi tester ensuite.
Sur 113 bugs Defects4J, le modèle Jev classe les suites de tests pour que 96 % des tests échoués apparaissent dans les 10 % premiers, surpassant BM25 et GPT-5.4 nano pour échouer les builds plus rapidement.
Question: given a patch, can you rank a test suite so the tests that fail show up first? On 113 Defects4J bugs, how often is a failing test in the first 10%? BM25 → 73% GPT-5.4 nano → 92% Jev → 96% fail your builds quicker instead of waiting :)