OPEN SOURCE · CURATED REPOSITORIES

Jev GitHub 项目.

经过筛选的 Jev SDK、工具、演示、集成、评测与研究项目。仓库指标来自 GitHub,标题、摘要与分类由 Jev Guide 整理。

750 个项目
13 个项目
sysadarshsysadarsh/zerosweep
评测开发者工具TypeScript

ZeroSweep:TypeSafe Jev 分流引擎与基准测试

由 TypeSafe AI 的 Jev System One 模型驱动的自主分流引擎与基准测试,展示具有校准置信度的高速邮件分类。

200
JevalsJevals/jevals-data
评测科研

Jevals 数据:TypeSafe Jev 基准测试数据集

独立的基准数据,比较 TypeSafe AI 的 Jev(System One 模型)与多种 LLM 在判定任务上的决策分数、准确率、校准、成本与延迟。

100CC-BY-4.0
arifulislamatarifulislamat/jev-benchmark
评测科研TypeScript

Jev 基准评测

调用 OpenRouter Decisions 端点评测 Jev (typesafe/jev-1.13) 在 100 个支持工单上的结构化决策成本、延迟与准确率,并与 Claude、GPT、Gemini 对比。

000MIT
Sunwood-ai-labsSunwood-ai-labs/jevdash
评测开发者工具Python

JevDash: System One

JevDash 是一个基于 Pygame 的 2D 平台游戏基准测试,通过实时控制场景评估 TypeSafe AI 的 Jev 模型,支持 Vercel AI Gateway 集成。

000MIT
planstack-aiplanstack-ai/jev-tetris-benchmark
评测开发者工具TypeScript

Jev 俄罗斯方块基准测试

一个可复现的俄罗斯方块决策基准,在相同棋盘上调用 TypeSafe Jev / System One 与 Claude Haiku,展示通过 Vercel AI Gateway 或 TypeSafe API 集成 Jev Choice。

000MIT
robokrunchrobokrunch/jev-physical-ai
评测科研Python

Jev 物理 AI 基准评测

对 TypeSafe Jev 在机器人车队和边缘硬件上的真实基准测试,包含 300 次实测 API 调用、成本分析和可复现脚本。

200MIT
clduab11clduab11/jev-test
评测科研Python

Jev-Test:TypeSafe Jev 决策模型预注册基准

预注册基准测试,检验 TypeSafe Jev 的置信度判断能否可靠地为 2B 本地模型决定搜索、证据与引用支持;包含测试框架、审计工具和开放的端到端结果。

100MIT
emretheusemretheus/jev-rag-benchmark
评测科研Python

Jev RAG 基准测试

针对 TypeSafe Jev 1.13 的免费 RAG 重排序与决策层基准,采用冻结候选池、配对 bootstrap 置信区间和概率校准,并与 NVIDIA cross-encoder 及无重排序基线对比。

000MIT
PsiACEPsiACE/dohnuts
评测科研Python

Dohnuts:与 Jev 对比的小型多模态决策模型

该项目构建面向直接决策的小型多模态模型,并在模型卡中与 TypeSafe Jev、Laya 等模型进行基准评测。

2430Apache-2.0
instax-duttainstax-dutta/sysone-bench
评测科研Python

sysone-bench:Jev 与 Laya 基准测试

首个在字节相同输入上独立对比 System One 决策模型 Laya 与 Jev 的基准,报告准确率、ECE、门控与延迟。

410MIT
EnesDemir143EnesDemir143/jev-laya-benchmark
评测开发者工具Python

Jev 与 Laya 基准测试

本地基准测试比较 TypeSafe Jev 与 Laya-MLX 在结构化问题分类上的表现。使用 Jev API 和 Noul 分数。

100
DililianxiceDililianxice/jev-inner-speech-bci
评测科研Python

Jev × 内心言语 BCI 基准测试

可复现的基准测试,评估 Jev 作为皮层内内心言语 BCI 解码的语义先验。报告 Jev 在合成交互中的输入效率信号以及在公开数据上的神经解码局限。

100MIT