Dane Jevals: niezależny benchmark dla TypeSafe Jev
Niezależne dane benchmarkowe porównujące Jev (model System One) od TypeSafe AI z różnymi LLM pod względem wyniku decyzji, dokładności, kalibracji, kosztu i opóźnienia.
AnyJev to otwarta biblioteka badawcza, która zamienia dowolny otwarty LLM w model decyzyjny w stylu Jev, oferując typowane decyzje, skalibrowane prawdopodobieństwa, kalibrację L0/L1 bez uczenia oraz porównania benchmarkowe z Jev.
该仓库是一个实质性的研究项目,实现并评测了Jev风格的决策模型(AnyJev),将任意LLM转换为带类型化决策和可靠概率的模型,并与TypeSafe AI的Jev结果进行对比,属于深入研究Jev/System One思路的技术资源。