Jev versus modelos de geração de texto
Jev não gera texto livre. Um vídeo lado a lado compara decisões paralelas com geração de texto token por token.

O autor ampliou o lote para cerca de 300 perguntas por chamada. Jev respondeu com sucesso, enquanto o Gemini rejeitou todas as solicitações antes de gerar qualquer coisa. A entrada tinha apenas ~55k tokens em uma janela de contexto de ~1M, indicando um problema na forma como o Gemini impõe saída estruturada.
5/7 Then I widened the batch to roughly 300 questions per call. ✅ Jev answered. ❌ Gemini rejected all 300 test requests before generating anything. The input was only ~55k tokens in a ~1M-token context window. The problem was how Gemini enforces structured output using a