TypeSafe AI in Zitationsprüfer integriert
Nutzer hat @typesafeai in seinen Zitationsprüfer aufgenommen und lobt es; kostenlos testbar bei PaperTrellis, Tags Jev und KI in der Medizin. Link
Im selben Test mit 430 Fällen ließ Jev 68–92 % der falschen Agentenberichte durch und Laya 84–88 % bei gezeigten Beweisen; stattdessen eine wörtliche Frage gestellt, ließ Jev nur etwa 1 % Fehler durch. Die Fragestellung ist wichtiger als das Modell.
Same 430-case test, two AI judges. Shown the evidence, Jev passed 68 to 92% of the false agent reports and Laya 84 to 88%. Asked one literal question instead, Jev let through about 1% of wrong counts and files. The question matters more than the model. https://cejel.dev/experiments