ZeroSweep: TypeSafe Jev triage-engine en benchmark
Een autonome triage-engine en benchmark, aangedreven door het Jev System One-model van TypeSafe AI, die snelle e-mailclassificatie met gekalibreerde betrouwbaarheid demonstreert.
OPEN SOURCE · CURATED REPOSITORIES
Curated Jev SDKs, tools, demos, integrations, benchmarks, and research projects. Repository metrics come from GitHub; titles, summaries, and categories are editorial.
Gerangschikt op GitHub Stars
Op recente Star-groei en updateactiviteit
Een autonome triage-engine en benchmark, aangedreven door het Jev System One-model van TypeSafe AI, die snelle e-mailclassificatie met gekalibreerde betrouwbaarheid demonstreert.
Onafhankelijke benchmarkgegevens die Jev (System One-model) van TypeSafe AI vergelijken met verschillende LLM's op beslissingsscore, nauwkeurigheid, kalibratie, kosten en latentie.
Benchmarkt Jev (typesafe/jev-1.13) via de decisions-endpoint van OpenRouter en vergelijkt kosten, latentie en nauwkeurigheid van getypeerde beslissingen op 100 supporttickets met Claude, GPT en Gemini.
JevDash is een op Pygame gebaseerde 2D-platformerbenchmark die het Jev-model van TypeSafe AI evalueert in realtime-besturingsscenario's, met Vercel AI Gateway-integratie.
Een reproduceerbare Tetris-beslissingsbenchmark die TypeSafe Jev / System One en Claude Haiku op identieke borden aanroept en de integratie van Jev Choice via Vercel AI Gateway of de TypeSafe-API demonstreert.
Real-world benchmark van TypeSafe Jev voor robotvloot en edge-hardware, met 300 gemeten API-aanroepen, kostenanalyse en reproduceerbare scripts.
Vooraf geregistreerde benchmark die test of de vertrouwensscores van TypeSafe Jev op betrouwbare wijze zoeken, bewijs en citatieondersteuning bepalen voor een lokaal 2B-model; bevat harness, audittool en open end-to-endresultaten.
Een gratis benchmark voor RAG-herrangschikking en beslissingslaag voor TypeSafe Jev 1.13, met bevroren kandidaatpools, gepaarde bootstrap-CI's en kalibratie, vergeleken met NVIDIA cross-encoder en baseline zonder herrangschikking.
Dit project bouwt kleine multimodale modellen voor directe beslissingen en vergelijkt ze met TypeSafe Jev en Laya in de modelkaart.
Eerste onafhankelijke head-to-head benchmark van System One-beslissingsmodellen Laya en Jev op byte-identieke invoer, met nauwkeurigheid, ECE, gating en latentie.
Lokale benchmark die TypeSafe Jev en Laya-MLX vergelijkt voor gestructureerde probleemclassificatie. Gebruikt de Jev API en Noul-scores.
Reproduceerbare benchmark die Jev evalueert als semantische prior voor intracorticale inner-speech-BCI-decodering. Rapporteert Jev's invoerefficiëntiesignaal in synthetische interacties en neurale decoderingslimieten op openbare gegevens.