Données Jevals : benchmark indépendant pour TypeSafe Jev
Données de référence indépendantes comparant Jev (modèle System One) de TypeSafe AI à plusieurs LLM sur le score de décision, la précision, la calibration, le coût et la latence.
Une évaluation indépendante du modèle Jev / System One de TypeSafe AI, avec 50 tests en chinois, 143 points de données traçables et scripts de reproduction.
该仓库是 Jev 模型的中文独立研究报告,包含 50 条实际 API 调用测试、复现脚本和 143 条可溯源数据表,深度研究了 TypeSafe AI 的 Jev / System One 模型。