Back to explore

Jev vs Gemini: Kiểm tra xử lý đầu ra có cấu trúc

Tác giả mở rộng lô lên khoảng 300 câu hỏi mỗi lần gọi. Jev trả lời thành công, trong khi Gemini từ chối tất cả yêu cầu trước khi tạo ra bất kỳ nội dung nào. Đầu vào chỉ khoảng 55k token trong cửa sổ ngữ cảnh ~1M token, chỉ ra vấn đề trong cách Gemini thực thi đầu ra có cấu trúc.

5/7 Then I widened the batch to roughly 300 questions per call. ✅ Jev answered. ❌ Gemini rejected all 300 test requests before generating anything. The input was only ~55k tokens in a ~1M-token context window. The problem was how Gemini enforces structured output using a

Jev vs Gemini: Kiểm tra xử lý đầu ra có cấu trúc 1
· 0 likesOpen on X