Back to explore

JevとGeminiを300件の顧客リクエストで比較

300件の顧客リクエストでJevとGeminiをテスト。より多くの質問をすることでモデル呼び出しが約7回から3回に減り、両モデルの精度が向上。誤った回答のフィルタリングでもJevは約4倍優れたトレードオフを示した。

1/7 I tested Jev and Gemini on 300 customer requests. Asking MORE questions cut the agent from ~7 model calls to 3, and made BOTH models more accurate. But Jev also had a nearly 4x better trade-off when filtering wrong answers. Then Gemini hit a limit that had nothing to do

JevとGeminiを300件の顧客リクエストで比較 1
· 1 likesOpen on X