Données Jevals : benchmark indépendant pour TypeSafe Jev
Données de référence indépendantes comparant Jev (modèle System One) de TypeSafe AI à plusieurs LLM sur le score de décision, la précision, la calibration, le coût et la latence.
Un audit pré-enregistré de Jev de TypeSafe AI en espagnol — précision, calibration et coût en tokens — plus une CLI pour exécuter la même comparaison sur vos propres données étiquetées.
该仓库是对 TypeSafe AI 的 Jev (System One) 模型在西班牙语上的预注册审计,包含准确性、校准和 token 成本评测,并提供 CLI 工具,与 Jev 直接相关。