Dados Jevals: benchmark independente para TypeSafe Jev
Dados de benchmark independentes comparando o Jev (modelo System One) da TypeSafe AI com vários LLMs em pontuação de decisão, precisão, calibração, custo e latência.
Uma auditoria pré-registrada do Jev da TypeSafe AI em espanhol — precisão, calibração e custo de tokens — além de uma CLI para executar a mesma comparação com seus próprios dados rotulados.
该仓库是对 TypeSafe AI 的 Jev (System One) 模型在西班牙语上的预注册审计,包含准确性、校准和 token 成本评测,并提供 CLI 工具,与 Jev 直接相关。