Dati Jevals: benchmark indipendente per TypeSafe Jev
Dati di benchmark indipendenti che confrontano Jev (modello System One) di TypeSafe AI con vari LLM su punteggio di decisione, accuratezza, calibrazione, costo e latenza.
Una valutazione indipendente del modello Jev / System One di TypeSafe AI, con 50 test in cinese, 143 punti dati tracciabili e script di riproduzione.
该仓库是 Jev 模型的中文独立研究报告,包含 50 条实际 API 调用测试、复现脚本和 143 条可溯源数据表,深度研究了 TypeSafe AI 的 Jev / System One 模型。