Jev превосходит Gemini 2.5 Flash Lite по качеству и скорости в оценке классификатора
Malte Ubl прогнал Jev от TypeSafe AI на существующей оценке классификатора: он насытил оценку по качеству и оказался в 6 раз быстрее Gemini 2.5 Flash Lite.
Сравнение JevBench от Benchmark Heaven показывает: Jev 1.13.0 получает 86,6% на публичных и 36,7% на закрытых данных, а GPT-6 Luna — 99,6% и 95,5%. Luna по-прежнему на 30-м месте в JevBench; важные факторы — ось стоимости (0,135 долл. против 0,040 долл. за 1000 решений) и порог ниже 50.
GPT-6 Luna (medium) gets nearly everything right: 99.6% public, 95.5% sealed. Jev 1.13.0: 86.6% and 36.7%. Luna still ranks #30 on JevBench. One column explains it: $0.135 per 1,000 decisions vs $0.040, Cost axis 36.0. Below 50, the gate applies. https://benchmarkheaven.com/jev-models/v1.4.1?compare=jev-1.13.0,gpt-6-luna…