Back to explore

Fragenstellung wichtiger als das Modell: Jev vs. Laya Test

Im selben Test mit 430 Fällen ließ Jev 68–92 % der falschen Agentenberichte durch und Laya 84–88 % bei gezeigten Beweisen; stattdessen eine wörtliche Frage gestellt, ließ Jev nur etwa 1 % Fehler durch. Die Fragestellung ist wichtiger als das Modell.

Same 430-case test, two AI judges. Shown the evidence, Jev passed 68 to 92% of the false agent reports and Laya 84 to 88%. Asked one literal question instead, Jev let through about 1% of wrong counts and files. The question matters more than the model. https://cejel.dev/experiments

Fragenstellung wichtiger als das Modell: Jev vs. Laya Test 1
· 0 likesOpen on X