Jevals-Daten: unabhängiger Benchmark für TypeSafe Jev
Unabhängige Benchmark-Daten, die TypeSafe AIs Jev (System One Modell) mit mehreren LLMs in Entscheidungs-Score, Genauigkeit, Kalibrierung, Kosten und Latenz vergleichen.
Ein Forschungs-Repository, das TypeSafes Jev/System One in einen TLA+-verifizierten Konsenskern einbettet, mit Rauschmessungen, Kalibrierungstests und 1.680 Chaos-getesteten Apothekenentscheidungen über die echte Jev-API.
仓库以 TypeSafe 的 Jev/System One 为核心,通过形式化验证、混沌测试和实际 API 调用深入测试共识内核,包含真实的 Jev API 调用、SDK 使用和评测数据。