Back to explore

Jev vs Gemini: Uji Penanganan Output Terstruktur

Penulis memperluas batch menjadi sekitar 300 pertanyaan per panggilan. Jev berhasil menjawab, sedangkan Gemini menolak semua permintaan sebelum menghasilkan apa pun. Inputnya hanya ~55k token dalam jendela konteks ~1M, menunjukkan masalah pada cara Gemini menerapkan output terstruktur.

5/7 Then I widened the batch to roughly 300 questions per call. ✅ Jev answered. ❌ Gemini rejected all 300 test requests before generating anything. The input was only ~55k tokens in a ~1M-token context window. The problem was how Gemini enforces structured output using a

Jev vs Gemini: Uji Penanganan Output Terstruktur 1
· 0 likesOpen on X