Back to GitHub projects

Jevals Data: Independent benchmark for TypeSafe Jev

Independent benchmark data comparing TypeSafe AI's Jev (System One model) against LLMs on decision score, accuracy, calibration, cost, and latency for typed tasks.

该仓库是 TypeSafe AI 的 Jev(System One 模型)的独立基准数据,包含实测准确率、校准、成本与延迟,并直接引用 Jev 及 Vercel AI Gateway 调用方式,属于对 Jev 的实质评估与数据集分享。

· 1 starsOpen on GitHub