OPEN SOURCE · CURATED REPOSITORIES

Jev GitHub-projekt.

Curated Jev SDKs, tools, demos, integrations, benchmarks, and research projects. Repository metrics come from GitHub; titles, summaries, and categories are editorial.

750 projects
18 projects
ReallyArtificialReallyArtificial/stuntdouble
Testning och utvärderingUtvecklarverktygJavaScript

stuntdouble: Skuggproxyutvärdering för Jev

En beroendefri Node-proxy som vidarebefordrar förfrågningar till TypeSafe Jev medan lokala modeller (Kev, Laya) fattar parallella beslut, och genererar en rapport om du kan byta ut den.

106MIT
NearCaiNearCai/JevLight
Testning och utvärderingVetenskaplig forskningPython

JevLight: CityFlow-baserat utvärderingsramverk för trafiksignalstyrning

Ett CityFlow-baserat ramverk för trafiksignalstyrning som utvärderar TypeSafe Jev- och OpenAI-kompatibla LLM-styrenheter tillsammans med regelbaserade och förstärkningsinlärningsbaslinjer genom samma simuleringspipeline.

000MIT
killerz3killerz3/jevalyzer
Testning och utvärderingUtvecklarverktygTypeScript

Jevalyzer - Utvärdera agentsessioner med Jev

En CLI som läser lokala kodningsagentsessionsloggar och betygsätter dem med Jev, TypeSafe AIs System One-modell, och genererar interaktiva HTML-rapporter och terminalinstrumentpaneler.

200MIT
andreaserradev-gbjandreaserradev-gbj/jev-access-day
Testning och utvärderingUtvecklarverktygTypeScript

Jev Access Day: utvärdering och jämförelse av TypeSafe System One

Anropar TypeSafe AIs Jev/System One-modell via den officiella SDK:n, jämför den med en LLM-ersättning över 24 operativa beslut och sparar reproducerbara resultat och utvärderingsrapporter.

000MIT
abhixhekabhixhek/jevcal
Testning och utvärderingUtvecklarverktygPython

jevcal: kalibreringsverktyg för konfidens för Jev/System One

CLI-/utvärderingsverktyg för TypeSafe Jev (System One): mäter tröskelvärden, kalibrerar konfidens och kontrollerar drift på dina egna data, med valfria etiketter från en LLM-lärare. Innehåller en demosimulator utan nyckel och liveintegration med Jev API.

1000MIT
marcosmartinezmarcosmartinez/jev-acento
Testning och utvärderingVetenskaplig forskningPython

Jev spansk accentrevision

En förregistrerad granskning av TypeSafe AI:s Jev på spanska — noggrannhet, kalibrering och tokenkostnad — plus ett CLI för att köra samma jämförelse på dina egna märkta data.

010MIT
rupeshpoojary9rupeshpoojary9/poorjev
Testning och utvärderingUtvecklarverktygPython

poorjev: Lokalt alternativ till Jev

Ett öppen källkods lokalt alternativ till TypeSafes Jev System One-modell, som ger typade beslut med kalibrerad konfidens. Inkluderar en tvärsystembenchmark mot Jev och andra lokala modeller.

700MIT
aryanchauhanofficalaryanchauhanoffical/no-hallucination
Testning och utvärderingVetenskaplig forskningPython

Utan hallucinationer: utvärdering av TypeSafe Jev i RAG

Tre uppmätta experiment om hallucinationer i RAG: citatkontroll, TypeSafes Jev och IBMs STAIR. Över 850 graderade frågor, råa svar ingår.

200MIT
gargpratyushgargpratyush/journey-evals
Testning och utvärderingUtvecklarverktygPython

Journey Evals

Journey Evals är ett utvärderingsverktyg som driver en riktig webbläsare eller en LangGraph-agent genom deklarerade användarresor och verifierar resultat med backend-bevis; det använder TypeSafes Jev för operation och elementval.

100
Kaos599Kaos599/jev-writer
Testning och utvärderingInnehållsskapandeJavaScript

jev-writer: skrivanalys med Jev

Open source-verktyg för innehållsanalys och LLM-utvärdering som betygsätter inlägg med kalibrerade omdömen från TypeSafe Jev (System One) och testar dem mot verklig engagemangsdata.

100MIT
gdchaochaogdchaochao/lunar-terminal
Testning och utvärderingVetenskaplig forskningPython

Lunar Terminal: utvärdering av TypeSafe Jev

Kod och rådata bakom Lunar Terminal: Robocode Tank Royale-robotar, GapFlap, en token-mätproxy och en randomiserad studie med 327 beslut om TypeSafe Jev.

000MIT
maciejczubmaciejczub/skill-siujev
Testning och utvärderingUtvecklarverktygPython

siujev – Ska jag använda Jev?

En agent-färdighet för Claude Code, Codex och Cursor som skannar ett repo eller en idé, kontrollerar Jevs lämplighet och felscenarier, uppskattar kostnad/latens och kör en livepilot mot TypeSafe API.

000MIT