Données Jevals : benchmark indépendant pour TypeSafe Jev
Données de référence indépendantes comparant Jev (modèle System One) de TypeSafe AI à plusieurs LLM sur le score de décision, la précision, la calibration, le coût et la latence.
Un dépôt de recherche qui encapsule le Jev/System One de TypeSafe dans un noyau de consensus vérifié en TLA+, avec mesures du plancher de bruit, sondes de calibration et 1 680 décisions pharmaceutiques testées sous chaos via l'API Jev réelle.
仓库以 TypeSafe 的 Jev/System One 为核心,通过形式化验证、混沌测试和实际 API 调用深入测试共识内核,包含真实的 Jev API 调用、SDK 使用和评测数据。