Jevals 数据:TypeSafe Jev 基准测试数据集
独立的基准数据,比较 TypeSafe AI 的 Jev(System One 模型)与多种 LLM 在判定任务上的决策分数、准确率、校准、成本与延迟。
100CC-BY-4.0
一个研究仓库,围绕 TypeSafe 的 Jev/System One 构建经 TLA+ 验证的共识内核,通过实时 Jev API 进行了噪声测量、校准探测和 1,680 轮混沌测试。
仓库以 TypeSafe 的 Jev/System One 为核心,通过形式化验证、混沌测试和实际 API 调用深入测试共识内核,包含真实的 Jev API 调用、SDK 使用和评测数据。