Back to explore

تقييم وضبط تصنيف استجابات استبيان الأمان لـ Jev

يناقش المنشور أداء Jev في تصنيف استجابات استبيان الأمان (منفذ، غير قابل للتطبيق، غير منفذ) مقارنة بـ Claude، مشيرًا إلى أن Jev احتاج إلى ضبط لتحقيق نتائج أكثر دقة.

#Jev security questionnaire response categorization (implemented, N/A, not implemented) given the question+response then a ground truth eval. - Claude initially performed better with little direction - Jev questions needed tuning to provide a more accurate response. Once tuned,

تقييم وضبط تصنيف استجابات استبيان الأمان لـ Jev 1
· 0 likesOpen on X