Data Jevals: tolok ukur independen untuk TypeSafe Jev
Data benchmark independen yang membandingkan Jev (model System One) dari TypeSafe AI dengan berbagai LLM dalam skor keputusan, akurasi, kalibrasi, biaya, dan latensi.
Enam eksperimen catur terekam yang memanggil TypeSafe Jev melalui OpenRouter: permainan mandiri, filter taktis, bantuan Stockfish, dan putaran peninjauan Jev, dengan jejak lengkap, tayangan ulang, dan catatan biaya.
仓库 README 明确说明通过 OpenRouter 调用 TypeSafe Jev 进行六次国际象棋对局实验,包含完整请求/响应、回放和成本记录,并附有运行脚本与测试,属于实质性的 Jev 实验项目。