Back to explore

Jev vs Gemini: teste com 300 solicitações de clientes

Em 300 solicitações de clientes, fazer perguntas úteis de what if tornou ambos os modelos mais rápidos e precisos. O Gemini ainda venceu em precisão, mas o Jev capturou mais respostas erradas, rejeitando incorretamente 70% menos respostas corretas, com verificação custando cerca de 1/11.

6/7 So, across 300 customer requests: Asking the useful “what ifs” together made BOTH models faster and more accurate. Gemini still won on accuracy. Jev caught more wrong answers while wrongly rejecting 70% fewer correct ones. With verification, it cost about 1/11th as much

Jev vs Gemini: teste com 300 solicitações de clientes 1
· 0 likesOpen on X