Jev jämfört med textgenererande modeller
Jev genererar inte fri text. En jämförelsevideo visar skillnaden mellan parallellt beslutsfattande och tokenvis textgenerering.

En användare körde Jev genom FizzBuzz 10 000 gånger och fann en felfrekvens på 77 %, nästan alltid på samma tal, där Jev anser att 56 är delbart med 5 med en konfidens på 0,18–0,30.
I ran Jev through FizzBuzz 10,000 times. And it failed 77% of the time, and almost always on the exact same number. For whatever reason, Jev seems to really think that the number 56 is divisible by 5, and it does so with a confidence between 0.18-0.30. I have no idea what it