Dados Jevals: benchmark independente para TypeSafe Jev
Dados de benchmark independentes comparando o Jev (modelo System One) da TypeSafe AI com vários LLMs em pontuação de decisão, precisão, calibração, custo e latência.
Repositório de pesquisa que envolve o Jev/System One da TypeSafe em um núcleo de consenso verificado com TLA+, incluindo medições de piso de ruído, sondas de calibração e 1.680 decisões farmacêuticas testadas com caos via API real do Jev.
仓库以 TypeSafe 的 Jev/System One 为核心,通过形式化验证、混沌测试和实际 API 调用深入测试共识内核,包含真实的 Jev API 调用、SDK 使用和评测数据。