Jev против моделей генерации текста
Jev не генерирует свободный текст. Сравнительное видео показывает различие между параллельным принятием решений и генерацией текста по токенам.

В посте утверждается, что преимущество Jev в скорости связано с техникой инференса, а не с обучением модели, и что, изменив движок инференса, можно дать любой открытой LLM производительный API в стиле Jev.
How is Jev so much faster than an LLM? It's not about how the model is trained - it's the inference technique. In fact, you can modify an inference engine to provide a performant Jev-like API with any open-weight LLM. Say you are trying to ask N multiple choice questions in