Back to explore

Utvärdering och justering av Jev:s klassificering av svar på säkerhetsformulär

Inlägget diskuterar Jev:s prestanda vid kategorisering av svar på säkerhetsformulär (implementerat, N/A, inte implementerat), jämfört med Claude, och noterar att Jev behövde justeras för mer exakta resultat.

#Jev security questionnaire response categorization (implemented, N/A, not implemented) given the question+response then a ground truth eval. - Claude initially performed better with little direction - Jev questions needed tuning to provide a more accurate response. Once tuned,

Utvärdering och justering av Jev:s klassificering av svar på säkerhetsformulär 1
· 0 likesOpen on X