Jev ชนะ Gemini 2.5 Flash Lite ทั้งด้านคุณภาพและความเร็วในการประเมินตัวจำแนก
Malte Ubl ทดลองใช้ Jev ของ TypeSafe AI กับชุดประเมินตัวจำแนกที่มีอยู่ โดยทำคะแนนคุณภาพได้เต็มชุดประเมินและเร็วกว่า Gemini 2.5 Flash Lite 6 เท่า
FLock.io เผยผลทดสอบความแม่นยำ 68 ข้อที่บันทึกโดยบุคคลที่สาม: โมเดล THIS/THAT 1.0 ของ FLock ได้ 94.1% ขณะที่ Jev (บริการ System One ที่โฮสต์) ได้ 76.5% โพสต์ระบุว่านี่เป็นผลลัพธ์ที่น่าพึงพอใจสำหรับโมเดลตัดสินใจเฉพาะทาง พร้อมชี้ว่างานซับซ้อนที่ต้องค้นหาแบบกราฟหรือคำนวณหลายขั้นตอนยังคงเป็นความท้าทาย
In a test of 68 questions recorded by a third party for accuracy: - FLock's THIS / THAT Model 1.0: 94.1% - Jev (hosted System One service): 76.5% A promising result for a specialised decision model. Complex tasks requiring graph search or multi-step arithmetic remain