Jev und CodeGraph für Security Reviews
Das Projekt typesafe-security-review kombiniert Jevs Wahrscheinlichkeitsurteile mit einem Codegraphen und OWASP/CWE Daten für günstige Security Scans.
Der Autor vergleicht Jev mit anderen Modellen auf seinem eigenen KI-Sicherheitsvalidierungsset, einem unabhängigen schwierigen benignen Benchmark und einem Drittanbieter-Benchmark und kommt zu dem Schluss, dass Jev nicht schlecht, aber nicht produktionsreif und nicht air-gapped ist.
Because everybody here is comparing Jev with other models. I compared Jev on our #AISecurity Validation set, a independent hard benign benchmark, and a third party hard benign one. Result: #Jev is far from bad but not production ready. Also not air gapped.