สร้างตัวจำแนกโค้ดเบสด้วย Jev
นักพัฒนแชร์การสร้างตัวจำแนกโค้ดเบสด้วย Jev โดยเสนอว่าอาจแก้ปัญหาโค้ดที่ซับซ้อนเกินไปจากเอเจนต์ และถามว่าควรทดสอบอะไรต่อไป
Hamel Husain ระบุว่า Jev ใช้สำหรับการประเมิน LLM ได้ เนื่องจาก LLM Judge เป็นตัวจำแนกประเภทโดยพื้นฐาน และแนะนำให้ทดสอบตัวจำแนกกับป้ายกำกับจากมนุษย์และหลีกเลี่ยงการโอเวอร์ฟิต
Can you use Jev for Evals? Yes! Remember that a LLM Judge is also classifier*. Make sure to test your classifiers against human labels and don't overfit. Hope this helps! * https://hamel.dev/blog/posts/evals-faq/why-do-you-recommend-binary-passfail-evaluations-instead-of-1-5-ratings-likert-scales.html…