pytest-jev: Jev로 LLM 출력에 대한 의미론적 어서션
pytest-jev는 TypeSafe의 Jev 모델을 사용하여 LLM 출력에 대한 의미론적 어서션을 추가하고 보정된 확률을 반환하는 pytest 플러그인입니다. holds/lacks/expect/choice/score 검사, 캐싱, 임계값 설정, OpenRouter 실행을 지원합니다.
OPEN SOURCE · CURATED REPOSITORIES
Curated Jev SDKs, tools, demos, integrations, benchmarks, and research projects. Repository metrics come from GitHub; titles, summaries, and categories are editorial.
GitHub Stars 기준
최근 Star 증가와 업데이트 활동 기준
pytest-jev는 TypeSafe의 Jev 모델을 사용하여 LLM 출력에 대한 의미론적 어서션을 추가하고 보정된 확률을 반환하는 pytest 플러그인입니다. holds/lacks/expect/choice/score 검사, 캐싱, 임계값 설정, OpenRouter 실행을 지원합니다.
TypeSafe Jev / System One의 Noul, Choice, Score 판정을 시각적 블록으로 제공하는 Blockly 확장 기능입니다. 라이브 데모, 튜토리얼, 실제 모델 기반 자동 테스트를 포함합니다.
Claude Code / Codex / pi 플러그인으로, 텍스트 출력이 필요 없는 에이전트 단계를 TypeSafe의 Jev system-one 모델로 라우팅하며, 측정된 지연 시간과 유형화된 에스컬레이션을 제공합니다.
TypeSafe Jev/System One을 사용하여 동적 도구 선택, 실행 전 호출 평가, 모델 라우팅, 스킬 라우팅을 수행하는 DeepSeek Harness 플러그인입니다. 실행 가능한 예제, 120개 테스트, 25개 평가 픽스처, Jev 유무에 따른 벤치마크를 포함합니다.
TypeSafe/Jev를 위한 고처리량 네이티브 DuckDB 확장으로, SQL에서 일괄 및 스트리밍 분류, 점수 매기기, 의미론적 술어 평가를 지원합니다.
TypeSafe Jev System One 결정 API(jev_check, jev_route, jev_score, jev_evaluate)를 Hermes Agent 도구로 노출합니다. 스키마, 경량 API 클라이언트, 사용 스킬, 통합 테스트를 포함합니다.
코딩 에이전트의 '완료' 주장을 결정적 저장소 증거, 일괄 TypeSafe Jev/System One 평가, 순수 정책으로 검증하는 DSH 플러그인입니다. 실패 시 열려 있고 분석 도구, 결정성 프로브, 실제 픽스처 테스트를 포함합니다.
TypeSafe의 Jev 모델을 사용해 코딩 에이전트에 대한 프롬프트를 평가하고 프롬프트 습관이 개선되는지 보여주는 Claude Code 플러그인입니다. 기본 모드는 추가 지연이 없습니다.
TypeSafe Jev systemone API(모델: jev-latest)를 호출해 검증된 읽기 전용 도구 증거를 핸드오프에 유지할지 결정하는 Codex 플러그인입니다. 스킬, MCP 도구, CLI, 오프라인 테스트, 측정된 로컬 결과를 포함합니다.
이 Claude Code 플러그인은 TypeSafe AI의 Jev API를 사용하여 더 저렴한 서브에이전트에 작업을 위임할 시기와 스폰별 모델/effort를 결정합니다. Jev 기반 프롬프트 트리아지, 스폰 게이트, 벤치마크 보고서를 포함합니다.
TypeSafe Jev 기반 OpenCode 플러그인으로, 모호한 사용자 요청을 감지하고 에이전트가 행동하기 전에 명확한 질문을 합니다.
System One API를 통해 TypeSafe AI의 Jev 모델을 사용하여 컨텍스트 압축 중 읽기 전용 도구 쌍을 유지할지 삭제할지 결정하는 Pi 확장입니다. 중요한 지시사항과 최근 메시지를 보존하며, Jev를 사용할 수 없으면 기본 압축으로 대체합니다.