Jev versus modelos de geração de texto
Jev não gera texto livre. Um vídeo lado a lado compara decisões paralelas com geração de texto token por token.

O post argumenta que a vantagem de velocidade do Jev vem da técnica de inferência, não do treinamento do modelo, e que é possível modificar um motor de inferência para dar a qualquer LLM de pesos abertos uma API semelhante ao Jev com alto desempenho.
How is Jev so much faster than an LLM? It's not about how the model is trained - it's the inference technique. In fact, you can modify an inference engine to provide a performant Jev-like API with any open-weight LLM. Say you are trying to ask N multiple choice questions in