Jev so với các mô hình tạo văn bản
Jev không tạo văn bản tự do. Video so sánh cho thấy khác biệt giữa ra quyết định song song và tạo văn bản từng token.

Tác giả mở rộng lô lên khoảng 300 câu hỏi mỗi lần gọi. Jev trả lời thành công, trong khi Gemini từ chối tất cả yêu cầu trước khi tạo ra bất kỳ nội dung nào. Đầu vào chỉ khoảng 55k token trong cửa sổ ngữ cảnh ~1M token, chỉ ra vấn đề trong cách Gemini thực thi đầu ra có cấu trúc.
5/7 Then I widened the batch to roughly 300 questions per call. ✅ Jev answered. ❌ Gemini rejected all 300 test requests before generating anything. The input was only ~55k tokens in a ~1M-token context window. The problem was how Gemini enforces structured output using a