Back to explore

Jev vs Gemini: test na 300 zapytaniach klientów

W 300 zapytaniach klientów zadawanie przydatnych pytań what if sprawiło, że oba modele były szybsze i dokładniejsze. Gemini nadal wygrywał pod względem dokładności, ale Jev wychwycił więcej błędnych odpowiedzi, błędnie odrzucając o 70% mniej poprawnych, a koszt weryfikacji wyniósł około 1/11.

6/7 So, across 300 customer requests: Asking the useful “what ifs” together made BOTH models faster and more accurate. Gemini still won on accuracy. Jev caught more wrong answers while wrongly rejecting 70% fewer correct ones. With verification, it cost about 1/11th as much

Jev vs Gemini: test na 300 zapytaniach klientów 1
· 0 likesOpen on X