Jev versus modelos de geração de texto
Jev não gera texto livre. Um vídeo lado a lado compara decisões paralelas com geração de texto token por token.

O autor tenta fazer o Jev, somente texto e sem entrada de imagem, entender formas básicas: renderiza uma forma em uma tela 64×64, aplica limiar e empacota cada bloco de 2×4 pixels em um glifo braille Unicode, transformando a imagem em 512 caracteres de texto puro para o Jev.
Can Jev understand basic shapes? Kind of. Jev is text-only. No image input at all. So I cheated. Render a shape to a 64×64 canvas, threshold it, and pack every 2×4 block of pixels into a Unicode braille glyph. The picture becomes 512 characters of plain text, which Jev can