Data Jevals: tolok ukur independen untuk TypeSafe Jev
Data benchmark independen yang membandingkan Jev (model System One) dari TypeSafe AI dengan berbagai LLM dalam skor keputusan, akurasi, kalibrasi, biaya, dan latensi.
Repositori riset yang membungkus Jev/System One dari TypeSafe dalam kernel konsensus terverifikasi TLA+, dengan pengukuran lantai derau, pemeriksaan kalibrasi, dan 1.680 keputusan farmasi yang diuji kekacauan melalui API Jev langsung.
仓库以 TypeSafe 的 Jev/System One 为核心,通过形式化验证、混沌测试和实际 API 调用深入测试共识内核,包含真实的 Jev API 调用、SDK 使用和评测数据。