Jev kontra modele generujące tekst
Jev nie generuje swobodnego tekstu. Film porównuje równoległe decyzje z generowaniem tekstu token po tokenie.

Post twierdzi, że przewaga szybkości Jev wynika z techniki wnioskowania, a nie z trenowania modelu, i że można zmodyfikować silnik wnioskowania, aby dowolny LLM o otwartych wagach oferował wydajne API w stylu Jev.
How is Jev so much faster than an LLM? It's not about how the model is trained - it's the inference technique. In fact, you can modify an inference engine to provide a performant Jev-like API with any open-weight LLM. Say you are trying to ask N multiple choice questions in