Back to explore

Jev Skill SuggestionとClaudeモデルのベンチマーク比較

26スキル・10プロンプト・各3回でJev Skill SuggestionとClaudeモデルを比較。Jevは精度90%・中央値330ms、Haikuは80%・1.24秒、Sonnet/Opus/Fableは100%・2.2〜4.5秒。Jevはわずかな精度と引き換えに4〜14倍高速な判断を実現。

I benchmarked Jev Skill Suggestion against Claude models with 26 skills, 10 prompts, and 3 runs each - Jev: 90% accuracy, 330ms median - Haiku: 80%, 1.24s - Sonnet/Opus/Fable: 100%, 2.2–4.5s So Jev trades a bit of accuracy for a 4–14× faster decision, while keeping the skill

Jev Skill SuggestionとClaudeモデルのベンチマーク比較 1
· 67 likesOpen on X