Dati Jevals: benchmark indipendente per TypeSafe Jev
Dati di benchmark indipendenti che confrontano Jev (modello System One) di TypeSafe AI con vari LLM su punteggio di decisione, accuratezza, calibrazione, costo e latenza.
Sei esperimenti di scacchi registrati che chiamano TypeSafe Jev tramite OpenRouter: gioco indipendente, filtro tattico, assistenza di Stockfish e un ciclo di revisione di Jev, con trace complete, replay e registri dei costi.
仓库 README 明确说明通过 OpenRouter 调用 TypeSafe Jev 进行六次国际象棋对局实验,包含完整请求/响应、回放和成本记录,并附有运行脚本与测试,属于实质性的 Jev 实验项目。