Back to GitHub projects

Jevals-Daten: unabhängiger Benchmark für TypeSafe Jev

Unabhängige Benchmark-Daten, die TypeSafe AIs Jev (System One Modell) mit mehreren LLMs in Entscheidungs-Score, Genauigkeit, Kalibrierung, Kosten und Latenz vergleichen.

该仓库是 TypeSafe AI 的 Jev(System One 模型)的独立基准数据,包含实测准确率、校准、成本与延迟,并直接引用 Jev 及 Vercel AI Gateway 调用方式,属于对 Jev 的实质评估与数据集分享。

· 1 starsOpen on GitHub