Dati Jevals: benchmark indipendente per TypeSafe Jev
Dati di benchmark indipendenti che confrontano Jev (modello System One) di TypeSafe AI con vari LLM su punteggio di decisione, accuratezza, calibrazione, costo e latenza.
Un audit pre-registrato di Jev di TypeSafe AI in spagnolo — accuratezza, calibrazione e costo dei token — più una CLI per eseguire lo stesso confronto sui tuoi dati etichettati.
该仓库是对 TypeSafe AI 的 Jev (System One) 模型在西班牙语上的预注册审计,包含准确性、校准和 token 成本评测,并提供 CLI 工具,与 Jev 直接相关。