Jev kontra modele generujące tekst
Jev nie generuje swobodnego tekstu. Film porównuje równoległe decyzje z generowaniem tekstu token po tokenie.

Autor próbuje nauczyć tekstowego Jev, bez wejścia obrazowego, rozumienia podstawowych kształtów: renderuje kształt na kanwie 64×64, proguje i pakuje każdy blok 2×4 pikseli w znak braille'a Unicode, zamieniając obraz w 512 znaków zwykłego tekstu dla Jev.
Can Jev understand basic shapes? Kind of. Jev is text-only. No image input at all. So I cheated. Render a shape to a 64×64 canvas, threshold it, and pack every 2×4 block of pixels into a Unicode braille glyph. The picture becomes 512 characters of plain text, which Jev can