Back to explore

Jev проти Gemini: тест на 300 клієнтських запитах

У 300 клієнтських запитах корисні запитання what if зробили обидві моделі швидшими та точнішими. Gemini все ще виграв у точності, але Jev виявив більше неправильних відповідей, помилково відхиляючи на 70% менше правильних, а вартість перевірки становила приблизно 1/11.

6/7 So, across 300 customer requests: Asking the useful “what ifs” together made BOTH models faster and more accurate. Gemini still won on accuracy. Jev caught more wrong answers while wrongly rejecting 70% fewer correct ones. With verification, it cost about 1/11th as much

Jev проти Gemini: тест на 300 клієнтських запитах 1
· 0 likesOpen on X