stuntdouble: Avaliação de proxy sombra para Jev
Um proxy Node sem dependências que encaminha solicitações para TypeSafe Jev enquanto modelos locais (Kev, Laya) tomam decisões paralelas, e gera um relatório sobre se você pode substituir.
OPEN SOURCE · CURATED REPOSITORIES
Curated Jev SDKs, tools, demos, integrations, benchmarks, and research projects. Repository metrics come from GitHub; titles, summaries, and categories are editorial.
Ordenado por Stars do GitHub
Por crescimento recente de Stars e atividade
Um proxy Node sem dependências que encaminha solicitações para TypeSafe Jev enquanto modelos locais (Kev, Laya) tomam decisões paralelas, e gera um relatório sobre se você pode substituir.
Um framework de controle de sinais de trânsito baseado em CityFlow que avalia controladores LLM compatíveis com TypeSafe Jev e OpenAI juntamente com baselines baseados em regras e aprendizado por reforço pelo mesmo pipeline de simulação.
Uma CLI que lê os logs de sessões de agentes de codificação locais e os pontua usando Jev, o modelo System One da TypeSafe AI, gerando relatórios HTML interativos e painéis de terminal.
Chama o modelo Jev/System One da TypeSafe AI via SDK oficial, compara-o com um substituto de LLM em 24 decisões operacionais e registra resultados reproduzíveis e relatórios de avaliação.
Ferramenta CLI/avaliação para TypeSafe Jev (System One): mede limites, calibra a confiança e verifica deriva nos seus próprios dados, com rotulagem opcional por professor LLM. Inclui um simulador de demonstração sem chave e integração real com a API Jev.
Uma auditoria pré-registrada do Jev da TypeSafe AI em espanhol — precisão, calibração e custo de tokens — além de uma CLI para executar a mesma comparação com seus próprios dados rotulados.
Uma alternativa local de código aberto ao modelo Jev System One da TypeSafe, fornecendo decisões tipadas com confiança calibrada. Inclui um benchmark entre sistemas contra Jev e outros modelos locais.
Três experimentos medidos sobre alucinação em RAG: verificação de citações, Jev da TypeSafe e STAIR da IBM. Mais de 850 perguntas graduadas, respostas brutas incluídas.
Journey Evals é uma ferramenta de avaliação que conduz um navegador real ou um agente LangGraph por jornadas de usuário declaradas e verifica os resultados com evidências do backend; usa o Jev da TypeSafe para operação e seleção de elementos.
Ferramenta open-source de análise de conteúdo e avaliação por LLM que classifica publicações com julgamentos calibrados do TypeSafe Jev (System One) e os compara com dados reais de engajamento.
Código e dados brutos por trás do Lunar Terminal: bots de Robocode Tank Royale, GapFlap, um proxy de medição de tokens e um ensaio randomizado de 327 decisões do TypeSafe Jev.
Uma skill de agente para Claude Code, Codex e Cursor que analisa um repositório ou ideia, verifica a adequação do Jev e seus modos de falha, estima custo/latência e executa um piloto ao vivo com a API TypeSafe.