Data Jevals: tolok ukur independen untuk TypeSafe Jev
Data benchmark independen yang membandingkan Jev (model System One) dari TypeSafe AI dengan berbagai LLM dalam skor keputusan, akurasi, kalibrasi, biaya, dan latensi.
Model multimodal mirip JEV yang disetel halus dari Qwen3.5-0.8B, memainkan sepuluh game browser dari piksel mentah secara real-time, dengan demo, kode pelatihan, dan evaluasi.
该仓库直接引用 TypeSafe Jev/System One,并实现了 JEV-like 多模态游戏模型,提供可运行 demo、训练代码、评估结果,属于实质研究。