Jev tegenover tekstgenererende modellen
Jev genereert geen vrije tekst. Een video vergelijkt parallel beslissen met token voor token tekstgeneratie.

De auteur stelt dat beslissingsmodellen lokaal draaien de beste aanpak is, dat ze klein genoeg kunnen zijn voor de meeste hardware en dat latentie geoptimaliseerd moet worden om beslissingen per seconde te maximaliseren.
Jev opened the box, but I believe that having your decisioning model run locally is the winning recipe. Decisioning models can certainly be made small enough for most hardware and you really want to maximize for latency with these models, as a higher decisions-per-second may be