Jev против моделей генерации текста
Jev не генерирует свободный текст. Сравнительное видео показывает различие между параллельным принятием решений и генерацией текста по токенам.

Taro L. Saito отмечает, что, как и Jev, локальный LLM-движок достигает вывода за 40 мс, отказавшись от генерации текста/JSON и специализируясь на суждениях, работая на DGX Spark.
Just like Jev, to think that a Local LLM engine capable of inference in 40ms is realized simply by abandoning text/json generation and specializing solely in judgment. It's running on DGX Spark, but anyway, it's incredibly fast.