Jevals 数据:TypeSafe Jev 基准测试数据集
独立的基准数据,比较 TypeSafe AI 的 Jev(System One 模型)与多种 LLM 在判定任务上的决策分数、准确率、校准、成本与延迟。
100CC-BY-4.0
TypeSafe AI 的 Jev (System One Model) 个人学习仓库,包含韩语研究笔记、TypeScript 类型与模拟实现,以及 confidence-gated routing 和校准评测。
仓库以 TypeScript 类型、模拟工作流、31 个测试和 6 篇韩语笔记详细研究 TypeSafe AI 的 Jev / System One 模型,包含 confidence-gated routing 和校准度量,内容实质且直接相关。