Jev face aux modèles générateurs de texte
Jev ne génère pas de texte libre. Une vidéo côte à côte compare la décision parallèle avec la génération token par token.

L'auteur estime que faire tourner les modèles de décision en local est la meilleure approche, qu'ils peuvent être assez petits pour la plupart des matériels et qu'il faut optimiser la latence pour maximiser les décisions par seconde.
Jev opened the box, but I believe that having your decisioning model run locally is the winning recipe. Decisioning models can certainly be made small enough for most hardware and you really want to maximize for latency with these models, as a higher decisions-per-second may be