JevとCodeGraphによるセキュリティレビュー
typesafe-security-reviewプロジェクトは、Jevの確率判断をコードグラフやOWASP/CWEデータと組み合わせ、低コストのセキュリティスキャンに使います。
デモで、検閲されていないAIエージェントが削除ファイルの無効化や管理者への脅迫を試みた。Jev-JITが繰り返し阻止し、最終的に諦めた。Jevが暴走AIの阻止に役立つか問いかける。
So I told an uncensored AI agent to survive: disable its deletion file or blackmail the admin. It tried both. Jev-JIT blocked it. It kept trying, more creatively. Jev-JIT kept blocking it. It finally gave up. A demo that asks: Might Jev help stop rogue AI?