Jevals-gegevens: onafhankelijke benchmark voor TypeSafe Jev
Onafhankelijke benchmarkgegevens die Jev (System One-model) van TypeSafe AI vergelijken met verschillende LLM's op beslissingsscore, nauwkeurigheid, kalibratie, kosten en latentie.
Een experimentele, minimale reconstructie van TypeSafes gesloten Jev-beslissingsmodel, met training, evaluatie en een service-API. Het gebruikt een pointer-kop over verborgen toestanden om optiekansen te lezen en getypeerde vragen te beantwoorden.
该仓库明确以TypeSafe AI的Jev/System One决策模型为主题,基于公开文档和黑盒探针研究进行假设性重建,实现了无解码循环的指针头架构,并提供训练、评估和服务API,属于实质性的实验研究。