Jev يتفوق على Gemini 2.5 Flash Lite في جودة وسرعة تقييم المصنف
شغّل Malte Ubl نموذج Jev من TypeSafe AI على تقييم مصنف موجود، فحقق تشبعًا في الجودة وكان أسرع 6 مرات من Gemini 2.5 Flash Lite.
تُظهر مقارنة JevBench من Benchmark Heaven أن Jev 1.13.0 يسجل 86.6% علني و36.7% مختوم، بينما تصل GPT-6 Luna إلى 99.6% و95.5%. لا تزال Luna في المرتبة 30 على JevBench، ويُفسَّر ذلك جزئياً بمحور التكلفة (0.135 دولار مقابل 0.040 دولار لكل 1000 قرار) وتطبيق الحد عند أقل من 50.
GPT-6 Luna (medium) gets nearly everything right: 99.6% public, 95.5% sealed. Jev 1.13.0: 86.6% and 36.7%. Luna still ranks #30 on JevBench. One column explains it: $0.135 per 1,000 decisions vs $0.040, Cost axis 36.0. Below 50, the gate applies. https://benchmarkheaven.com/jev-models/v1.4.1?compare=jev-1.13.0,gpt-6-luna…