Back to explore

Benchmark di Jev Skill Suggestion contro i modelli Claude

Jev Skill Suggestion è stato confrontato con i modelli Claude con 26 skill, 10 prompt e 3 esecuzioni ciascuno: Jev 90% di accuratezza e 330 ms di mediana; Haiku 80% e 1,24 s; Sonnet/Opus/Fable 100% e 2,2–4,5 s. Jev sacrifica un po' di accuratezza per decisioni 4–14× più rapide.

I benchmarked Jev Skill Suggestion against Claude models with 26 skills, 10 prompts, and 3 runs each - Jev: 90% accuracy, 330ms median - Haiku: 80%, 1.24s - Sonnet/Opus/Fable: 100%, 2.2–4.5s So Jev trades a bit of accuracy for a 4–14× faster decision, while keeping the skill

Benchmark di Jev Skill Suggestion contro i modelli Claude 1
· 67 likesOpen on X