Jevals-gegevens: onafhankelijke benchmark voor TypeSafe Jev
Onafhankelijke benchmarkgegevens die Jev (System One-model) van TypeSafe AI vergelijken met verschillende LLM's op beslissingsscore, nauwkeurigheid, kalibratie, kosten en latentie.
Een onderzoeksrepository die TypeSafe's Jev/System One omhult in een TLA+-geverifieerde consensuskern, met metingen van de ruisvloer, kalibratiesondes en 1.680 chaos-geteste apotheekbeslissingen via de live Jev-API.
仓库以 TypeSafe 的 Jev/System One 为核心,通过形式化验证、混沌测试和实际 API 调用深入测试共识内核,包含真实的 Jev API 调用、SDK 使用和评测数据。