stuntdouble: Jev 섀도 프록시 평가
제로 의존성 Node 프록시로, TypeSafe Jev로의 요청을 전달하면서 로컬 모델(Kev, Laya)로 섀도 결정을 수행하고 교체 가능 여부에 대한 보고서를 생성합니다.
OPEN SOURCE · CURATED REPOSITORIES
Curated Jev SDKs, tools, demos, integrations, benchmarks, and research projects. Repository metrics come from GitHub; titles, summaries, and categories are editorial.
GitHub Stars 기준
최근 Star 증가와 업데이트 활동 기준
제로 의존성 Node 프록시로, TypeSafe Jev로의 요청을 전달하면서 로컬 모델(Kev, Laya)로 섀도 결정을 수행하고 교체 가능 여부에 대한 보고서를 생성합니다.
CityFlow 기반 교통 신호 제어 프레임워크로, TypeSafe Jev 및 OpenAI 호환 LLM 컨트롤러를 규칙 기반 및 강화 학습 기준선과 동일한 시뮬레이션 파이프라인으로 평가합니다.
로컬 코딩 에이전트 세션 로그를 읽고 TypeSafe AI의 System One 모델인 Jev로 점수를 매기고 대화형 HTML 보고서와 터미널 대시보드를 생성하는 CLI입니다.
공식 SDK를 통해 TypeSafe AI의 Jev/System One 모델을 호출하고 24가지 운영 결정을 LLM 대리 모델과 비교하며, 재현 가능한 실행 결과와 평가 보고서를 커밋합니다.
TypeSafe Jev(System One)용 CLI/평가 도구입니다. 자체 데이터에서 임계값을 측정하고 신뢰도를 보정하며 드리프트를 확인합니다. 선택적으로 LLM 교사 라벨링을 사용할 수 있고, 키 없이 실행되는 데모 시뮬레이터와 Jev API 실측 연동을 포함합니다.
TypeSafe AI의 Jev를 스페인어로 평가한 사전 등록 감사. 정확도, 보정, 토큰 비용을 측정하고 자신의 레이블 데이터로 비교하는 CLI를 제공합니다.
TypeSafe의 Jev System One 모델의 오픈소스 로컬 대안으로, 보정된 신뢰도로 유형화된 결정을 제공합니다. Jev 및 다른 로컬 모델과의 교차 시스템 벤치마크를 포함합니다.
RAG 환각에 대한 세 가지 측정 실험: 인용 확인, TypeSafe의 Jev, IBM의 STAIR. 850개 이상의 등급별 질문과 원시 응답 포함.
Journey Evals는 선언된 사용자 여정을 따라 실제 브라우저나 LangGraph 에이전트를 구동하고 백엔드 증거로 결과를 검증하는 평가 도구입니다. 작업 및 요소 선택에 TypeSafe의 Jev를 사용합니다.
TypeSafe Jev(System One)의 보정된 판단으로 게시물을 평가하고 실제 참여 데이터와 대조하는 오픈소스 콘텐츠 분석 및 LLM 평가 도구입니다.
Lunar Terminal 뒤의 코드와 원시 데이터: Robocode Tank Royale 봇, GapFlap, 토큰 계측 프록시, TypeSafe Jev의 327개 결정 무작위 시험.
Claude Code, Codex, Cursor용 에이전트 스킬로, 저장소나 아이디어를 스캔하고 Jev 적합성과 실패 모드를 확인하며 비용/지연 시간을 추정하고 TypeSafe API로 라이브 파일럿을 실행합니다.