Bygga en kodbas-klassificerare med Jev
En utvecklare delar bygget av en kodbas-klassificerare med Jev, föreslår att det kan lösa överkonstruerad kod från agenter, och frågar vad som ska testas härnäst.
Inlägget delar pris och benchmarkresultat för Grok 4.7 i Cursor och förklarar att Jev med hjälp av en Noul/Choice/Score-loop avgör om modellanropet ska tillåtas, efterfrågas eller hoppas över.
GROK 4.7 IS $2/$6 IN CURSOR. Jev now decides if the model even wakes up same sticker as 4.6. live in Cursor and Grok Build. CursorBench 4.0: 46.3. DeepSWE v1.1: 71.0. Terminal-Bench 4.0: 37.6. the loop: repo state → Jev Noul/Choice/Score → allow / ask / skip → only then