Jevals 数据:TypeSafe Jev 基准测试数据集
独立的基准数据,比较 TypeSafe AI 的 Jev(System One 模型)与多种 LLM 在判定任务上的决策分数、准确率、校准、成本与延迟。
100CC-BY-4.0
TypeSafe Jev(System One 模型)的实践研究实验室:提供 Noul/Choice/Score 原语的可复现基准测试、置信度门控、扇出延迟、智能体控制,以及对 Jev 生态的持续审计。
仓库 llt22/jev-lab 以 TypeSafe Jev / System One 模型为核心,包含可复现基准测试(Noul/Choice/Score、置信度门控、扇出延迟等)、SDK/集成列表、研究档案和社区审计,实质内容充分,属于深入研究项目。