Jev im Vergleich zu textgenerierenden Modellen
Jev erzeugt keinen freien Text. Ein Vergleichsvideo zeigt den Unterschied zwischen paralleler Entscheidungsfindung und tokenweiser Texterzeugung.

Der Autor versucht, dem rein textbasierten Jev ohne Bildeingabe grundlegende Formen verständlich zu machen: Eine Form wird auf eine 64×64-Leinwand gerendert, schwellenwertisiert und jeder 2×4-Pixelblock in ein Unicode-Braille-Zeichen gepackt, sodass das Bild zu 512 Klartextzeichen für Jev wird.
Can Jev understand basic shapes? Kind of. Jev is text-only. No image input at all. So I cheated. Render a shape to a 64×64 canvas, threshold it, and pack every 2×4 block of pixels into a Unicode braille glyph. The picture becomes 512 characters of plain text, which Jev can