Jevals-gegevens: onafhankelijke benchmark voor TypeSafe Jev
Onafhankelijke benchmarkgegevens die Jev (System One-model) van TypeSafe AI vergelijken met verschillende LLM's op beslissingsscore, nauwkeurigheid, kalibratie, kosten en latentie.
Een kalibratie-arena voor TypeSafe Jev, die de betrouwbaarheid van native waarschijnlijkheid meet via Brier/ECE op analytisch bekende willekeurige werelden, met live API-resultaten.
该仓库是一个针对 TypeSafe Jev 的校准评测竞技场,包含真实 API 实测、Brier/ECE 可靠性分析及可运行 demo,明确集成并深入研究 Jev / System One 模型。