Données Jevals : benchmark indépendant pour TypeSafe Jev
Données de référence indépendantes comparant Jev (modèle System One) de TypeSafe AI à plusieurs LLM sur le score de décision, la précision, la calibration, le coût et la latence.
Une reconstruction expérimentale et minimale du modèle de décision fermé Jev de TypeSafe, avec entraînement, évaluation et API de service. Elle utilise une tête de pointeur sur les états cachés pour lire les probabilités des options et répondre à des questions typées.
该仓库明确以TypeSafe AI的Jev/System One决策模型为主题,基于公开文档和黑盒探针研究进行假设性重建,实现了无解码循环的指针头架构,并提供训练、评估和服务API,属于实质性的实验研究。