Jev rispetto ai modelli che generano testo
Jev non genera testo libero. Un video affiancato confronta decisioni parallele e generazione token per token.

Il post sostiene che il vantaggio di velocità di Jev deriva dalla tecnica di inferenza, non dall'addestramento del modello, e che si può modificare un motore di inferenza per offrire a qualsiasi LLM a pesi aperti un'API simile a Jev ad alte prestazioni.
How is Jev so much faster than an LLM? It's not about how the model is trained - it's the inference technique. In fact, you can modify an inference engine to provide a performant Jev-like API with any open-weight LLM. Say you are trying to ask N multiple choice questions in