Back to explore

Jev vs Gemini: Test av strukturerad utdata

Författaren utökade batchen till cirka 300 frågor per anrop. Jev svarade framgångsrikt, medan Gemini avvisade alla förfrågningar innan något genererades. Inmatningen var endast ~55k tokens i ett kontextfönster på ~1M, vilket indikerar ett problem med hur Gemini tvingar fram strukturerad utdata.

5/7 Then I widened the batch to roughly 300 questions per call. ✅ Jev answered. ❌ Gemini rejected all 300 test requests before generating anything. The input was only ~55k tokens in a ~1M-token context window. The problem was how Gemini enforces structured output using a

Jev vs Gemini: Test av strukturerad utdata 1
· 0 likesOpen on X