Jevals Data: oberoende riktmärke för TypeSafe Jev
Oberoende benchmarkdata som jämför TypeSafe AI:s Jev (System One-modellen) med flera LLM:er i beslutspoäng, noggrannhet, kalibrering, kostnad och latens.
En experimentell, minimal rekonstruktion av TypeSafes stängda Jev-beslutsmodell, med träning, utvärdering och en serverings-API. Den använder ett pekarhuvud över dolda tillstånd för att läsa sannolikheter för alternativ och svara på typsatta frågor.
该仓库明确以TypeSafe AI的Jev/System One决策模型为主题,基于公开文档和黑盒探针研究进行假设性重建,实现了无解码循环的指针头架构,并提供训练、评估和服务API,属于实质性的实验研究。