Jevals-Daten: unabhängiger Benchmark für TypeSafe Jev
Unabhängige Benchmark-Daten, die TypeSafe AIs Jev (System One Modell) mit mehreren LLMs in Entscheidungs-Score, Genauigkeit, Kalibrierung, Kosten und Latenz vergleichen.
Eine vorregistrierte Prüfung von TypeSafe AIs Jev auf Spanisch – Genauigkeit, Kalibrierung und Token-Kosten – plus eine CLI, um den gleichen Vergleich mit eigenen gekennzeichneten Daten durchzuführen.
该仓库是对 TypeSafe AI 的 Jev (System One) 模型在西班牙语上的预注册审计,包含准确性、校准和 token 成本评测,并提供 CLI 工具,与 Jev 直接相关。