stuntdouble: Skuggproxyutvärdering för Jev
En beroendefri Node-proxy som vidarebefordrar förfrågningar till TypeSafe Jev medan lokala modeller (Kev, Laya) fattar parallella beslut, och genererar en rapport om du kan byta ut den.
OPEN SOURCE · CURATED REPOSITORIES
Curated Jev SDKs, tools, demos, integrations, benchmarks, and research projects. Repository metrics come from GitHub; titles, summaries, and categories are editorial.
Rangordnade efter GitHub Stars
Efter senaste Star-tillväxt och uppdateringsaktivitet
En beroendefri Node-proxy som vidarebefordrar förfrågningar till TypeSafe Jev medan lokala modeller (Kev, Laya) fattar parallella beslut, och genererar en rapport om du kan byta ut den.
Ett CityFlow-baserat ramverk för trafiksignalstyrning som utvärderar TypeSafe Jev- och OpenAI-kompatibla LLM-styrenheter tillsammans med regelbaserade och förstärkningsinlärningsbaslinjer genom samma simuleringspipeline.
En CLI som läser lokala kodningsagentsessionsloggar och betygsätter dem med Jev, TypeSafe AIs System One-modell, och genererar interaktiva HTML-rapporter och terminalinstrumentpaneler.
Anropar TypeSafe AIs Jev/System One-modell via den officiella SDK:n, jämför den med en LLM-ersättning över 24 operativa beslut och sparar reproducerbara resultat och utvärderingsrapporter.
CLI-/utvärderingsverktyg för TypeSafe Jev (System One): mäter tröskelvärden, kalibrerar konfidens och kontrollerar drift på dina egna data, med valfria etiketter från en LLM-lärare. Innehåller en demosimulator utan nyckel och liveintegration med Jev API.
En förregistrerad granskning av TypeSafe AI:s Jev på spanska — noggrannhet, kalibrering och tokenkostnad — plus ett CLI för att köra samma jämförelse på dina egna märkta data.
Ett öppen källkods lokalt alternativ till TypeSafes Jev System One-modell, som ger typade beslut med kalibrerad konfidens. Inkluderar en tvärsystembenchmark mot Jev och andra lokala modeller.
Tre uppmätta experiment om hallucinationer i RAG: citatkontroll, TypeSafes Jev och IBMs STAIR. Över 850 graderade frågor, råa svar ingår.
Journey Evals är ett utvärderingsverktyg som driver en riktig webbläsare eller en LangGraph-agent genom deklarerade användarresor och verifierar resultat med backend-bevis; det använder TypeSafes Jev för operation och elementval.
Open source-verktyg för innehållsanalys och LLM-utvärdering som betygsätter inlägg med kalibrerade omdömen från TypeSafe Jev (System One) och testar dem mot verklig engagemangsdata.
Kod och rådata bakom Lunar Terminal: Robocode Tank Royale-robotar, GapFlap, en token-mätproxy och en randomiserad studie med 327 beslut om TypeSafe Jev.
En agent-färdighet för Claude Code, Codex och Cursor som skannar ett repo eller en idé, kontrollerar Jevs lämplighet och felscenarier, uppskattar kostnad/latens och kör en livepilot mot TypeSafe API.