Back to explore

Jev проти Gemini: порівняльний тест на 300 клієнтських запитах

Автор протестував Jev і Gemini на 300 клієнтських запитах. Більше запитань скоротило виклики моделі з ~7 до 3 і підвищило точність обох. Jev також показав майже в 4 рази кращий компроміс під час фільтрації неправильних відповідей.

1/7 I tested Jev and Gemini on 300 customer requests. Asking MORE questions cut the agent from ~7 model calls to 3, and made BOTH models more accurate. But Jev also had a nearly 4x better trade-off when filtering wrong answers. Then Gemini hit a limit that had nothing to do

Jev проти Gemini: порівняльний тест на 300 клієнтських запитах 1
· 1 likesOpen on X