Jevals 数据:TypeSafe Jev 基准测试数据集
独立的基准数据,比较 TypeSafe AI 的 Jev(System One 模型)与多种 LLM 在判定任务上的决策分数、准确率、校准、成本与延迟。
100CC-BY-4.0
LightJev 是一个受 TypeSafe AI 的 Jev 启发的独立 Python 实现:它使用 CE/Brier 损失训练小型语言骨干以进行类型化决策,提供评估,并包含离线演示。它不声称复现 TypeSafe AI 的专有架构或 RLCD 训练方法。
该仓库是受 TypeSafe AI Jev 启发的独立 Python 实现,包含 CE/Brier 训练、评测、CLI 与离线可运行 demo,并明确引用 Jev 与 NanoJev-Data,内容实质且与 TypeSafe Jev 直接相关;但未调用官方 API 或复现其专有架构。