Dati Jevals: benchmark indipendente per TypeSafe Jev
Dati di benchmark indipendenti che confrontano Jev (modello System One) di TypeSafe AI con vari LLM su punteggio di decisione, accuratezza, calibrazione, costo e latenza.
AnyJev è una libreria di ricerca aperta che trasforma qualsiasi LLM aperto in un modello decisionale stile Jev, con decisioni tipizzate, probabilità calibrate, calibrazione L0/L1 senza training e confronti benchmark con Jev.
该仓库是一个实质性的研究项目,实现并评测了Jev风格的决策模型(AnyJev),将任意LLM转换为带类型化决策和可靠概率的模型,并与TypeSafe AI的Jev结果进行对比,属于深入研究Jev/System One思路的技术资源。