สร้างตัวจำแนกโค้ดเบสด้วย Jev
นักพัฒนแชร์การสร้างตัวจำแนกโค้ดเบสด้วย Jev โดยเสนอว่าอาจแก้ปัญหาโค้ดที่ซับซ้อนเกินไปจากเอเจนต์ และถามว่าควรทดสอบอะไรต่อไป
การเปรียบเทียบของ Benchmark Heaven แสดงให้เห็นว่า Jev 1.13.0 เกือบเทียบเท่า Winnow-12B Q8 ในด้านความแม่นยำสาธารณะและต้นทุน โดย Jev นำในด้านการปรับเทียบและคะแนน
Winnow-12B Q8 (#4) and Jev 1.13.0 (#1) are nearly level on public accuracy, 85.7% vs 86.6%, and on Cost, 52.9 vs 52.0. The gap is confidence. Calibration 64.8 vs 76.3; sealed set 33.1% vs 36.7%. Score 55.58 vs 63.29. https://benchmarkheaven.com/jev-models/v1.4.1?compare=jev-1.13.0,winnow-12b…