Jev против моделей генерации текста
Jev не генерирует свободный текст. Сравнительное видео показывает различие между параллельным принятием решений и генерацией текста по токенам.

Автор считает, что локальный запуск моделей принятия решений — выигрышный подход: такие модели можно сделать достаточно малыми для большинства оборудования, а задержку стоит оптимизировать ради роста числа решений в секунду.
Jev opened the box, but I believe that having your decisioning model run locally is the winning recipe. Decisioning models can certainly be made small enough for most hardware and you really want to maximize for latency with these models, as a higher decisions-per-second may be