Jev versus modelos de geração de texto
Jev não gera texto livre. Um vídeo lado a lado compara decisões paralelas com geração de texto token por token.

O autor defende que executar modelos de decisão localmente é a melhor abordagem, pois podem ser pequenos o suficiente para a maioria do hardware e a latência deve ser otimizada para maximizar decisões por segundo.
Jev opened the box, but I believe that having your decisioning model run locally is the winning recipe. Decisioning models can certainly be made small enough for most hardware and you really want to maximize for latency with these models, as a higher decisions-per-second may be