Back to explore

Jev nie jest LLM: zwraca typowane odpowiedzi i prawdopodobieństwa, wygrywa benchmark cytowań

Jev nie jest LLM; zwraca typowaną odpowiedź i prawdopodobieństwo, a nie tekst. W 42 kontrolach cytowań przeciw GPT-5.4, Sonnet 5 i Gemini 3.1 Pro Jev wygrał na prawdziwych opublikowanych zdaniach 77,8% do 66,7% przy 1/50 kosztu. W tym repozytorium benchmarku na GitHub.

Jev is not an LLM. It returns a typed answer and a probability, no text. 42 citation checks vs GPT-5.4, Sonnet 5 and Gemini 3.1 Pro. They won the easy half 100%. It won the real published sentences, 77.8% to 66.7%, at 1/50th the cost. https://github.com/TheWayWithin/jev-bench…

Jev nie jest LLM: zwraca typowane odpowiedzi i prawdopodobieństwa, wygrywa benchmark cytowań 1
· 0 likesOpen on X