Jev tegenover tekstgenererende modellen
Jev genereert geen vrije tekst. Een video vergelijkt parallel beslissen met token voor token tekstgeneratie.

Het bericht stelt dat het snelheidsvoordeel van Jev komt door de inferentietechniek, niet door modeltraining, en dat een inferentie-engine kan worden aangepast om elke open-weight LLM een performante Jev-achtige API te geven.
How is Jev so much faster than an LLM? It's not about how the model is trained - it's the inference technique. In fact, you can modify an inference engine to provide a performant Jev-like API with any open-weight LLM. Say you are trying to ask N multiple choice questions in