Back to explore

Jev ist kein LLM: liefert typisierte Antworten und Wahrscheinlichkeiten, gewinnt Zitat-Benchmark

Jev ist kein LLM; es liefert eine typisierte Antwort und eine Wahrscheinlichkeit, keinen Text. Bei 42 Zitatprüfungen gegen GPT-5.4, Sonnet 5 und Gemini 3.1 Pro gewann Jev bei echten veröffentlichten Sätzen mit 77,8 % zu 66,7 % bei 1/50 der Kosten. Inklusive GitHub-Benchmark-Repository.

Jev is not an LLM. It returns a typed answer and a probability, no text. 42 citation checks vs GPT-5.4, Sonnet 5 and Gemini 3.1 Pro. They won the easy half 100%. It won the real published sentences, 77.8% to 66.7%, at 1/50th the cost. https://github.com/TheWayWithin/jev-bench…

Jev ist kein LLM: liefert typisierte Antworten und Wahrscheinlichkeiten, gewinnt Zitat-Benchmark 1
· 0 likesOpen on X