ZeroSweep: เอ็นจินคัดแยกและเบนช์มาร์ก Jev จาก TypeSafe
เอ็นจินคัดแยกอัตโนมัติและเบนช์มาร์กที่ขับเคลื่อนด้วยโมเดล Jev System One จาก TypeSafe AI แสดงการจำแนกอีเมลความเร็วสูงพร้อมความเชื่อมั่นที่ปรับเทียบแล้ว
OPEN SOURCE · CURATED REPOSITORIES
Curated Jev SDKs, tools, demos, integrations, benchmarks, and research projects. Repository metrics come from GitHub; titles, summaries, and categories are editorial.
จัดอันดับตาม GitHub Stars
ตามการเพิ่ม Star และการอัปเดตล่าสุด
เอ็นจินคัดแยกอัตโนมัติและเบนช์มาร์กที่ขับเคลื่อนด้วยโมเดล Jev System One จาก TypeSafe AI แสดงการจำแนกอีเมลความเร็วสูงพร้อมความเชื่อมั่นที่ปรับเทียบแล้ว
ข้อมูลเกณฑ์มาตรฐานอิสระที่เปรียบเทียบ Jev (โมเดล System One) ของ TypeSafe AI กับ LLM หลายตัวในด้านคะแนนการตัดสินใจ ความแม่นยำ การปรับเทียบ ต้นทุน และความหน่วง
วัดประสิทธิภาพ Jev (typesafe/jev-1.13) ผ่าน decisions endpoint ของ OpenRouter เปรียบเทียบต้นทุน ความหน่วง และความแม่นยำของการตัดสินใจแบบมีชนิดใน 100 ตั๋วสนับสนุนกับ Claude, GPT และ Gemini
JevDash เป็นเกณฑ์มาตรฐานแพลตฟอร์ม 2D ที่ใช้ Pygame ในการประเมินโมเดล Jev ของ TypeSafe AI สำหรับสถานการณ์ควบคุมแบบเรียลไทม์ พร้อมการผสาน Vercel AI Gateway
เกณฑ์มาตรฐานการตัดสินใจ Tetris ที่สามารถทำซ้ำได้ ซึ่งเรียก TypeSafe Jev / System One และ Claude Haiku บนกระดานเดียวกัน และแสดงการผสาน Jev Choice ผ่าน Vercel AI Gateway หรือ TypeSafe API
เกณฑ์มาตรฐานจริงของ TypeSafe Jev สำหรับฝูงหุ่นยนต์และฮาร์ดแวร์เอจ ไม่ว่าจะเป็นการเรียก API 300 ครั้งที่วัดผล การวิเคราะห์ต้นทุน และสคริปต์ที่ทำซ้ำได้
เกณฑ์มาตรฐานที่ลงทะเบียนล่วงหน้าซึ่งทดสอบว่าคะแนนความมั่นใจของ TypeSafe Jev ตัดสินการค้นหา หลักฐาน และการสนับสนุนการอ้างอิงสำหรับโมเดลท้องถิ่น 2B ได้อย่างน่าเชื่อถือหรือไม่ ประกอบด้วย harness เครื่องมือตรวจสอบ และผลลัพธ์แบบ end-to-end ที่เปิดเผย
เกณฑ์มาตรฐานฟรีสำหรับการจัดอันดับใหม่ RAG และเลเยอร์การตัดสินใจสำหรับ TypeSafe Jev 1.13 โดยใช้กลุ่มผู้สมัครที่แช่แข็ง, CI bootstrap แบบคู่ และการปรับเทียบ เปรียบเทียบกับ cross-encoder ของ NVIDIA และ baseline ที่ไม่มีการจัดอันดับใหม่
โปรเจกต์นี้สร้างโมเดลมัลติโมดัลขนาดเล็กสำหรับการตัดสินใจโดยตรง และเปรียบเทียบกับ TypeSafe Jev และ Laya ในโมเดลการ์ด
เกณฑ์มาตรฐานอิสระแรกแบบเผชิญหน้ากันของโมเดลการตัดสินใจ System One Laya และ Jev บนอินพุตที่เหมือนกันทุกไบต์ รายงานความแม่นยำ ECE การเกต และเวลาแฝง
การเปรียบเทียบในเครื่องระหว่าง TypeSafe Jev และ Laya-MLX สำหรับการจำแนกปัญหาที่มีโครงสร้าง ใช้ API Jev และคะแนน Noul
เกณฑ์มาตรฐานที่ทำซ้ำได้เพื่อประเมิน Jev ในฐานะความเชื่อก่อนเชิงความหมายสำหรับการถอดรหัส BCI คำพูดภายในในคอร์เทกซ์ รายงานสัญญาณประสิทธิภาพการป้อนข้อมูลของ Jev ในการโต้ตอบสังเคราะห์และข้อจำกัดของการถอดรหัสประสาทบนข้อมูลสาธารณะ