Dati Jevals: benchmark indipendente per TypeSafe Jev
Dati di benchmark indipendenti che confrontano Jev (modello System One) di TypeSafe AI con vari LLM su punteggio di decisione, accuratezza, calibrazione, costo e latenza.
Un modello multimodale simile a JEV ottimizzato da Qwen3.5-0.8B, gioca dieci giochi da browser da pixel grezzi in tempo reale, con demo, codice di addestramento e valutazione.
该仓库直接引用 TypeSafe Jev/System One,并实现了 JEV-like 多模态游戏模型,提供可运行 demo、训练代码、评估结果,属于实质研究。