Dados Jevals: benchmark independente para TypeSafe Jev
Dados de benchmark independentes comparando o Jev (modelo System One) da TypeSafe AI com vários LLMs em pontuação de decisão, precisão, calibração, custo e latência.
Um projeto de aprendizado que implementa um endpoint de decisão no estilo TypeSafe Jev/System One sobre um backbone Qwen3-0.6B com LoRA, além de um servidor de chat/geração compatível com OpenAI e avaliação compatível com MiniJev. Não é software de produção.
README 明确以 TypeSafe Jev/System One 的概念和 API 规范为基础,实现了 /v1/systemone 决策接口,并在 Qwen3-0.6B + LoRA 上进行训练、服务与评测,包含 MiniJev 对照和 holdout 结果,属于真实深入的研究/实验项目。