Dane Jevals: niezależny benchmark dla TypeSafe Jev
Niezależne dane benchmarkowe porównujące Jev (model System One) od TypeSafe AI z różnymi LLM pod względem wyniku decyzji, dokładności, kalibracji, kosztu i opóźnienia.
Arena kalibracji dla TypeSafe Jev, mierząca niezawodność natywnych prawdopodobieństw przez Brier/ECE na analitycznie znanych losowych światach, z wynikami na żywo z API.
该仓库是一个针对 TypeSafe Jev 的校准评测竞技场,包含真实 API 实测、Brier/ECE 可靠性分析及可运行 demo,明确集成并深入研究 Jev / System One 模型。