Back to explore

Jev vs Gemini : Test de gestion de sortie structurée

L'auteur a élargi le lot à environ 300 questions par appel. Jev a répondu correctement, tandis que Gemini a rejeté toutes les requêtes avant de générer quoi que ce soit. L'entrée ne faisait que ~55k tokens dans un contexte de ~1M, pointant un problème dans la manière dont Gemini impose la sortie structurée.

5/7 Then I widened the batch to roughly 300 questions per call. ✅ Jev answered. ❌ Gemini rejected all 300 test requests before generating anything. The input was only ~55k tokens in a ~1M-token context window. The problem was how Gemini enforces structured output using a

Jev vs Gemini : Test de gestion de sortie structurée 1
· 0 likesOpen on X