Jev ve metin üreten modeller
Jev serbest biçimli metin üretmez. Yan yana video, paralel karar alma ile token token metin üretimi arasındaki farkı gösterir.

Taro L. Saito, Jev gibi yerel bir LLM motorunun metin/JSON üretimini bırakıp yargıya odaklanarak DGX Spark üzerinde 40 ms çıkarım sağladığını belirtiyor.
Just like Jev, to think that a Local LLM engine capable of inference in 40ms is realized simply by abandoning text/json generation and specializing solely in judgment. It's running on DGX Spark, but anyway, it's incredibly fast.