Dados Jevals: benchmark independente para TypeSafe Jev
Dados de benchmark independentes comparando o Jev (modelo System One) da TypeSafe AI com vários LLMs em pontuação de decisão, precisão, calibração, custo e latência.
Um modelo multimodal semelhante a JEV ajustado a partir de Qwen3.5-0.8B, jogando dez jogos de navegador a partir de pixels brutos em tempo real, com demonstração, código de treinamento e avaliação.
该仓库直接引用 TypeSafe Jev/System One,并实现了 JEV-like 多模态游戏模型,提供可运行 demo、训练代码、评估结果,属于实质研究。