Back to GitHub projects

Benchmark de Jev

Evalúa Jev (typesafe/jev-1.13) a través del endpoint decisions de OpenRouter, comparando costo, latencia y precisión de decisiones tipadas en 100 tickets de soporte con Claude, GPT y Gemini.

仓库通过 OpenRouter decisions 端点调用 Jev (typesafe/jev-1.13),对 100 个支持工单进行结构化决策基准测试,包含成本、延迟、准确率对比,以及可运行的脚本和前端重放,是真实的 Jev 集成与评测。

· 0 starsOpen on GitHub