Jev i CodeGraph do przeglądu bezpieczeństwa
Projekt typesafe-security-review łączy probabilistyczne oceny Jev z grafem kodu i danymi OWASP/CWE do taniego skanowania bezpieczeństwa.
Cytowany blog podaje, że Jev osiąga dokładność zero-shot na poziomie 81,2% na BANKING77, poniżej 89,9% dla MiniLM+head liniowy; wstrzyknięty tekst przesunął prawdopodobieństwo przewidywania z 0,76 do 0,48, co sugeruje potencjalne ryzyko bezpieczeństwa.
⚠️ Caveats: • Vendor evals score agreement with GPT-6 Astra + Fable 5.1, not ground truth • BANKING77 (@manojlds): MiniLM + linear head 89.9%, Jev zero-shot 81.2% • Injected text moved a block prob 0.76 → 0.48 https://stacktoheap.com/blog/2026/09/22/jev-attack-of-the-classifiers/…