Dati Jevals: benchmark indipendente per TypeSafe Jev
Dati di benchmark indipendenti che confrontano Jev (modello System One) di TypeSafe AI con vari LLM su punteggio di decisione, accuratezza, calibrazione, costo e latenza.
Un progetto di apprendimento che implementa un endpoint decisionale in stile TypeSafe Jev/System One su un backbone Qwen3-0.6B con LoRA, più un server chat/generazione compatibile con OpenAI e una valutazione compatibile con MiniJev. Non è software di produzione.
README 明确以 TypeSafe Jev/System One 的概念和 API 规范为基础,实现了 /v1/systemone 决策接口,并在 Qwen3-0.6B + LoRA 上进行训练、服务与评测,包含 MiniJev 对照和 holdout 结果,属于真实深入的研究/实验项目。