pytest-jev: Jev による LLM 出力の意味的アサーション
pytest-jev は、TypeSafe の Jev モデルを使い、LLM 出力に対する意味的アサーションと較正された確率を提供する pytest プラグインです。holds/lacks/expect/choice/score チェック、キャッシュ、しきい値設定、OpenRouter 経由の実行に対応しています。
OPEN SOURCE · CURATED REPOSITORIES
Curated Jev SDKs, tools, demos, integrations, benchmarks, and research projects. Repository metrics come from GitHub; titles, summaries, and categories are editorial.
GitHub Stars順
最近のStar増加と更新状況で順位付け
pytest-jev は、TypeSafe の Jev モデルを使い、LLM 出力に対する意味的アサーションと較正された確率を提供する pytest プラグインです。holds/lacks/expect/choice/score チェック、キャッシュ、しきい値設定、OpenRouter 経由の実行に対応しています。
TypeSafe Jev / System One の Noul・Choice・Score 判定をビジュアルブロックとして公開する Blockly 拡張機能。ライブデモ、チュートリアル、実モデルを使った自動テストを備えています。
Claude Code / Codex / pi 向けプラグイン。テキスト出力を必要としないエージェントのステップを TypeSafe の Jev system-one モデルにルーティングし、測定されたレイテンシーと型付きエスカレーションを提供します。
TypeSafe Jev/System One を使用して、動的ツール選択、実行前コール評価、モデルルーティング、スキルルーティングを行う DeepSeek Harness プラグインです。実行可能な例、120 のテスト、25 の評価フィクスチャ、Jev あり/なしのベンチマークを含みます。
TypeSafe/Jev 向けの高スループットなネイティブ DuckDB 拡張で、SQL からバッチ/ストリーミング分類、スコアリング、セマンティック述語評価を可能にします。
TypeSafe Jev System One の決定 API(jev_check、jev_route、jev_score、jev_evaluate)を Hermes Agent のツールとして公開します。スキーマ、薄い API クライアント、利用スキル、統合テストを含みます。
DSH プラグイン。決定的なリポジトリ証拠と、1回のバッチ化されたTypeSafe Jev/System One評価、純粋なポリシーを組み合わせて、コーディングエージェントの「完了」主張を検証します。フェイルオープンで、分析ツール、決定性プローブ、実データのフィクスチャテストを含みます。
TypeSafe の Jev モデルを使ってコーディングエージェントへのプロンプトを採点し、プロンプトの習慣が改善しているかを示す Claude Code プラグイン。デフォルトモードでは追加の遅延はありません。
TypeSafe Jev systemone API(モデル: jev-latest)を呼び出し、検証済みの読み取り専用ツール証跡を引き継ぎコンテキストに残すか判定する Codex プラグイン。スキル、MCP ツール、CLI、オフラインテスト、計測結果を含みます。
このClaude CodeプラグインはTypeSafe AIのJev APIを使用して、より安価なサブエージェントに作業を委任するタイミングと、スパウンごとのモデルとeffortを判断します。Jevを利用したプロンプトトリアージ、スパウンゲート、ベンチマークレポートを含みます。
TypeSafe Jev を利用した OpenCode プラグイン。曖昧なユーザー要求を検出し、エージェントが行動する前に確認質問を行います。
TypeSafe AI の Jev モデルを System One API 経由で使用し、コンテキスト圧縮時に読み取り専用ツールのペアを保持するか削除するかを決定する Pi 拡張機能。重要な指示と最近のメッセージを保持し、Jev が利用できない場合はネイティブ圧縮にフォールバックします。