Back to explore

Jev vs Gemini:構造化出力の比較テスト

著者はバッチを1コールあたり約300問に拡大しました。Jevは正常に回答したのに対し、Geminiは生成前に全リクエストを拒否。入力は約100万トークンのコンテキストウィンドウ内でわずか約5.5万トークンであり、Geminiの構造化出力の強制方法に問題があることを示しています。

5/7 Then I widened the batch to roughly 300 questions per call. ✅ Jev answered. ❌ Gemini rejected all 300 test requests before generating anything. The input was only ~55k tokens in a ~1M-token context window. The problem was how Gemini enforces structured output using a

Jev vs Gemini:構造化出力の比較テスト 1
· 0 likesOpen on X