Dati Jevals: benchmark indipendente per TypeSafe Jev
Dati di benchmark indipendenti che confrontano Jev (modello System One) di TypeSafe AI con vari LLM su punteggio di decisione, accuratezza, calibrazione, costo e latenza.
Un motore decisionale da 151 milioni di parametri basato su ModernBERT che supera TypeSafe Jev e Laya nel benchmark LocalLLaMA/typed-decisions con precisione del 77,10% e punteggio Brier di 0,0636, e include una demo nel browser via WebGPU.
该仓库构建并评测了一个基于 ModernBERT 的非自回归决策引擎,在 LocalLLaMA/typed-decisions 基准上与 TypeSafe Jev 1.13.0 对比,受 Jev 架构启发,并提供 WebGPU 可运行 demo,属于对 TypeSafe Jev 模型的深入研究。