Datos de Jevals: benchmark independiente para TypeSafe Jev
Datos de referencia independientes que comparan Jev (modelo System One) de TypeSafe AI con varios LLM en puntuación de decisión, precisión, calibración, costo y latencia.
Una reconstrucción experimental y mínima del modelo de decisión Jev cerrado de TypeSafe, con entrenamiento, evaluación y una API de servicio. Utiliza una cabeza de puntero sobre estados ocultos para leer probabilidades de opciones y responder preguntas tipadas.
该仓库明确以TypeSafe AI的Jev/System One决策模型为主题,基于公开文档和黑盒探针研究进行假设性重建,实现了无解码循环的指针头架构,并提供训练、评估和服务API,属于实质性的实验研究。