Jevals-Daten: unabhängiger Benchmark für TypeSafe Jev
Unabhängige Benchmark-Daten, die TypeSafe AIs Jev (System One Modell) mit mehreren LLMs in Entscheidungs-Score, Genauigkeit, Kalibrierung, Kosten und Latenz vergleichen.
Eine experimentelle, minimale Rekonstruktion des geschlossenen Jev-Entscheidungsmodells von TypeSafe mit Training, Bewertung und Serving-API. Es verwendet einen Zeigerkopf über verborgenen Zuständen, um Optionswahrscheinlichkeiten zu lesen und typisierte Fragen zu beantworten.
该仓库明确以TypeSafe AI的Jev/System One决策模型为主题,基于公开文档和黑盒探针研究进行假设性重建,实现了无解码循环的指针头架构,并提供训练、评估和服务API,属于实质性的实验研究。