Back to explore

Jev vs Gemini : test sur 300 demandes clients

Sur 300 demandes clients, poser des questions utiles de type what if a rendu les deux modèles plus rapides et plus précis. Gemini a toujours gagné en précision, mais Jev a détecté plus de mauvaises réponses tout en rejetant à tort 70 % de bonnes réponses en moins, avec un coût de vérification d'environ 1/11.

6/7 So, across 300 customer requests: Asking the useful “what ifs” together made BOTH models faster and more accurate. Gemini still won on accuracy. Jev caught more wrong answers while wrongly rejecting 70% fewer correct ones. With verification, it cost about 1/11th as much

Jev vs Gemini : test sur 300 demandes clients 1
· 0 likesOpen on X