stuntdouble: Jev için gölge proxy değerlendirmesi
Sıfır bağımlılıklı Node proxy'si; istekleri TypeSafe Jev'e iletirken yerel modellerin (Kev, Laya) paralel kararlar almasını sağlar ve değiştirme yapıp yapamayacağınıza dair rapor üretir.
OPEN SOURCE · CURATED REPOSITORIES
Curated Jev SDKs, tools, demos, integrations, benchmarks, and research projects. Repository metrics come from GitHub; titles, summaries, and categories are editorial.
GitHub Stars değerine göre
Son Star artışı ve güncelleme etkinliğine göre
Sıfır bağımlılıklı Node proxy'si; istekleri TypeSafe Jev'e iletirken yerel modellerin (Kev, Laya) paralel kararlar almasını sağlar ve değiştirme yapıp yapamayacağınıza dair rapor üretir.
TypeSafe Jev ve OpenAI uyumlu LLM denetleyicilerini kural tabanlı ve pekiştirmeli öğrenme taban çizgileriyle aynı simülasyon hattında değerlendiren CityFlow tabanlı bir trafik sinyal kontrol çerçevesi.
Yerel kodlama aracısı oturum günlüklerini okuyan ve TypeSafe AI'nın System One modeli Jev ile puanlayan, etkileşimli HTML raporları ve terminal panoları üreten bir CLI.
TypeSafe AI'nin Jev/System One modelini resmi SDK ile çağırır, 24 operasyonel kararda bunu bir LLM stand-in'iyle karşılaştırır ve yeniden üretilebilir çalışma sonuçları ile değerlendirme raporlarını kaydeder.
TypeSafe Jev (System One) için CLI/değerlendirme aracı: kendi verilerinizde eşikleri ölçer, güveni kalibre eder ve sürüklenmeyi denetler; isteğe bağlı olarak LLM öğretmen etiketleri kullanır. Anahtar gerektirmeyen demo simülatörü ve canlı Jev API entegrasyonu içerir.
TypeSafe AI'nin Jev'ini İspanyolca üzerinde önceden kayıtlı bir denetim — doğruluk, kalibrasyon ve token maliyeti — ayrıca kendi etiketli verilerinizde aynı karşılaştırmayı çalıştırmak için bir CLI.
TypeSafe'in Jev System One modelinin açık kaynaklı yerel bir alternatifi olup, kalibre edilmiş güvenle yazılmış kararlar sağlar. Jev ve diğer yerel modellere karşı çapraz sistem kıyaslaması içerir.
RAG halüsinasyonu üzerine üç ölçümlü deney: alıntı kontrolü, TypeSafe'in Jev'i ve IBM'in STAIR'ı. 850+ derecelendirilmiş soru, ham yanıtlar dahil.
Journey Evals, gerçek bir tarayıcıyı veya LangGraph aracısını tanımlanmış kullanıcı yolculukları boyunca süren ve sonuçları arka uç kanıtlarıyla doğrulayan bir değerlendirme aracıdır; işlem ve öğe seçimi için TypeSafe'in Jev'ini kullanır.
TypeSafe Jev (System One) tarafından kalibre edilmiş yargılarla gönderileri puanlayan ve gerçek etkileşim verileriyle test eden açık kaynaklı içerik analitiği ve LLM değerlendirme aracı.
Lunar Terminal'in arkasındaki kod ve ham veriler: Robocode Tank Royale botları, GapFlap, token ölçüm proxy'si ve TypeSafe Jev'in 327 kararlı randomize denemesi.
Claude Code, Codex ve Cursor için; bir depoyu veya fikri tarayan, Jev uygunluğunu ve hata modlarını kontrol eden, maliyet/gecikme tahmini yapan ve TypeSafe API ile canlı pilot çalıştıran bir ajan becerisi.