Jev против моделей генерации текста
Jev не генерирует свободный текст. Сравнительное видео показывает различие между параллельным принятием решений и генерацией текста по токенам.

У Jev нет этапа декодирования: ответ получается за один проход prefill, что делает его примерно в 200 раз быстрее традиционного LLM-судьи.
Why is Jev ~200x faster than an LLM judge? Short answer: it has no decode stage. The answer comes out of a single prefill pass. 🧵