stuntdouble:Jevシャドウプロキシ評価
ゼロ依存のNodeプロキシで、TypeSafe Jevへのリクエストを転送しつつローカルモデル(Kev、Laya)でシャドウ決定を行い、置き換え可能かどうかのレポートを生成します。
OPEN SOURCE · CURATED REPOSITORIES
Curated Jev SDKs, tools, demos, integrations, benchmarks, and research projects. Repository metrics come from GitHub; titles, summaries, and categories are editorial.
GitHub Stars順
最近のStar増加と更新状況で順位付け
ゼロ依存のNodeプロキシで、TypeSafe Jevへのリクエストを転送しつつローカルモデル(Kev、Laya)でシャドウ決定を行い、置き換え可能かどうかのレポートを生成します。
CityFlow ベースの交通信号制御フレームワークで、TypeSafe Jev および OpenAI 互換 LLM コントローラを、ルールベースおよび強化学習ベースラインと同一のシミュレーションパイプラインで評価します。
ローカルのコーディングエージェントセッションログを読み取り、TypeSafe AIのSystem OneモデルであるJevでスコアリングし、インタラクティブなHTMLレポートとターミナルダッシュボードを生成するCLIツールです。
公式 SDK を介して TypeSafe AI の Jev/System One モデルを呼び出し、24 の運用判断について LLM スタンドインと比較し、再現可能な実行結果と評価レポートをコミットしています。
TypeSafe Jev(System One)向けのCLI/評価ツールです。自前データでしきい値を測定し、信頼度を調整し、ドリフトをチェックできます。LLMティーチャーによるラベル付けもオプションで可能。APIキー不要のデモシミュレーターと、Jev APIとの実際の連携を含みます。
TypeSafe AIのJevをスペイン語で評価した事前登録監査。精度、キャリブレーション、トークンコストを測定し、自分のラベル付きデータで比較するCLIを提供。
TypeSafeのJev System Oneモデルのオープンソースのローカル代替品で、校正された信頼度を持つ型付き決定を提供します。Jevおよび他のローカルモデルとのクロスシステムベンチマークを含みます。
RAG幻覚に関する3つの測定実験:引用チェック、TypeSafeのJev、IBMのSTAIR。850以上のグレード付き質問と生の応答を含む。
Journey Evals は、宣言されたユーザージャーニーに沿って実際のブラウザまたはLangGraphエージェントを操作し、バックエンドの証拠で結果を検証する評価ツールです。操作と要素選択にTypeSafeのJevを使用します。
TypeSafe Jev(System One)の較正された判定で投稿を評価し、実際のエンゲージメントデータと照合するオープンソースのコンテンツ分析・LLM評価ツールです。
Lunar Terminal の背後にあるコードと生データ:Robocode Tank Royale ボット、GapFlap、トークン計測プロキシ、TypeSafe Jev の327決定ランダム化試験。
Claude Code、Codex、Cursor 向けのエージェントスキル。リポジトリやアイデアをスキャンし、Jev の適合性と障害モードを確認し、コスト/レイテンシを推定し、TypeSafe API でライブパイロットを実行します。