Back to explore

Oberoende utvärdering av Jev på AI-säkerhetsvalideringsset

Författaren jämför Jev med andra modeller på sin egen AI-säkerhetsvalideringsset, ett oberoende svårt benign benchmark och ett tredjeparts svårt benign benchmark, och drar slutsatsen att Jev inte är dålig men inte produktionsklar och inte luftgapad.

Because everybody here is comparing Jev with other models. I compared Jev on our #AISecurity Validation set, a independent hard benign benchmark, and a third party hard benign one. Result: #Jev is far from bad but not production ready. Also not air gapped.

Oberoende utvärdering av Jev på AI-säkerhetsvalideringsset 1
· 0 likesOpen on X