JevalsJevals/jevals-data评测科研Jevals 数据:TypeSafe Jev 基准测试数据集独立的基准数据,比较 TypeSafe AI 的 Jev(System One 模型)与多种 LLM 在判定任务上的决策分数、准确率、校准、成本与延迟。100CC-BY-4.0
NearCaiNearCai/JevLight测试与评估科研PythonJevLight:基于CityFlow的交通信号控制评测框架基于 CityFlow 的交通信号控制框架,通过同一仿真流程评估 TypeSafe Jev 和 OpenAI 兼容 LLM 控制器,并与规则和强化学习基线对比。000MIT
choxoschoxos/jev-reviewerWeb 应用科研JavaScriptJev Reviewer:系统综述数据抽取使用 TypeSafe AI 的 Jev/System One 模型(jev-1.13.0)从研究报告与附件中逐字定位答案,支持 RoB 2、ROBINS-I、QUADAS-2 等模板;文件在浏览器本地处理,不上传服务器。3261MIT