Jev et CodeGraph pour la revue de sécurité
Le projet typesafe-security-review combine les jugements probabilistes de Jev avec un graphe de code et des données OWASP/CWE pour un scan de sécurité peu coûteux.
L'auteur compare Jev à d'autres modèles sur son propre ensemble de validation de sécurité IA, un benchmark bénin difficile indépendant et un benchmark bénin difficile tiers, concluant que Jev n'est pas mauvais mais pas prêt pour la production et non isolé.
Because everybody here is comparing Jev with other models. I compared Jev on our #AISecurity Validation set, a independent hard benign benchmark, and a third party hard benign one. Result: #Jev is far from bad but not production ready. Also not air gapped.