Back to GitHub projects

Jev-benchmark

Benchmarkt Jev (typesafe/jev-1.13) via de decisions-endpoint van OpenRouter en vergelijkt kosten, latentie en nauwkeurigheid van getypeerde beslissingen op 100 supporttickets met Claude, GPT en Gemini.

仓库通过 OpenRouter decisions 端点调用 Jev (typesafe/jev-1.13),对 100 个支持工单进行结构化决策基准测试,包含成本、延迟、准确率对比,以及可运行的脚本和前端重放,是真实的 Jev 集成与评测。

· 0 starsOpen on GitHub