Jev يسرّع Computer Use: ذاكرة LLM مع تنفيذ Jev
يحتفظ LLM بالذاكرة والسياق، ويستخدم agent-desktop لالتقاط اللقطات وإرسالها إلى Jev، الذي يختار العنصر الصحيح لتنفيذ الإجراء، مما يسرّع Computer Use مع دعم Cursor والوضع بلا واجهة.
يشارك مطور أن وكيل الصوت لديه كان ينتظر ثوانٍ في كل دورة عند تشغيل Qwen3 على 4090؛ وباستخدام Jev لقرارات الاختيار/صحيح-خطأ/التقييم، يوجّه كل دورة في ~100 مللي ثانية ولا يشغّل GPU إلا عند الحاجة الفعلية للاستدلال.
Our voice agent runs Qwen3 on a 4090. Every turn waits seconds. Jev can't talk. It only decides: choice, true/false, score. Now Jev routes each turn in ~100ms. The GPU only fires when reasoning is truly needed. We spent months making inference faster. The fix: infer less.