Budowanie klasyfikatora bazy kodu z Jev
Deweloper dzieli się budową klasyfikatora bazy kodu z Jev, sugerując, że może rozwiązać problem przekombinowanego kodu od agentów, i pyta, co testować dalej.
Post podaje cenę i wyniki benchmarków Grok 4.7 w Cursorze oraz wyjaśnia, że Jev używa pętli Noul/Choice/Score, aby zdecydować, czy zezwolić na wywołanie modelu, zapytać czy je pominąć.
GROK 4.7 IS $2/$6 IN CURSOR. Jev now decides if the model even wakes up same sticker as 4.6. live in Cursor and Grok Build. CursorBench 4.0: 46.3. DeepSWE v1.1: 71.0. Terminal-Bench 4.0: 37.6. the loop: repo state → Jev Noul/Choice/Score → allow / ask / skip → only then