Back to explore

Jev Skill Suggestion im Benchmark gegen Claude-Modelle

Jev Skill Suggestion wurde mit 26 Skills, 10 Prompts und je 3 Durchläufen gegen Claude-Modelle getestet: Jev 90 % Genauigkeit bei 330 ms Median; Haiku 80 % bei 1,24 s; Sonnet/Opus/Fable 100 % bei 2,2–4,5 s. Jev tauscht etwas Genauigkeit gegen 4–14× schnellere Entscheidungen.

I benchmarked Jev Skill Suggestion against Claude models with 26 skills, 10 prompts, and 3 runs each - Jev: 90% accuracy, 330ms median - Haiku: 80%, 1.24s - Sonnet/Opus/Fable: 100%, 2.2–4.5s So Jev trades a bit of accuracy for a 4–14× faster decision, while keeping the skill

Jev Skill Suggestion im Benchmark gegen Claude-Modelle 1
· 67 likesOpen on X