Jev kontra modele generujące tekst
Jev nie generuje swobodnego tekstu. Film porównuje równoległe decyzje z generowaniem tekstu token po tokenie.

Autor twierdzi, że uruchamianie modeli decyzyjnych lokalnie to najlepsze podejście, mogą być wystarczająco małe dla większości sprzętu, a opóźnienie należy optymalizować, by zwiększyć liczbę decyzji na sekundę.
Jev opened the box, but I believe that having your decisioning model run locally is the winning recipe. Decisioning models can certainly be made small enough for most hardware and you really want to maximize for latency with these models, as a higher decisions-per-second may be