Back to explore

محرك LLM محلي على نمط Jev: استدلال في 40 مللي ثانية مخصص للحكم

يشير Taro L. Saito إلى أن محرك LLM محليًا، مثل Jev، يحقق استدلالًا في 40 مللي ثانية عبر التخلي عن توليد النص/JSON والتخصص في الحكم، ويعمل على DGX Spark.

Just like Jev, to think that a Local LLM engine capable of inference in 40ms is realized simply by abandoning text/json generation and specializing solely in judgment. It's running on DGX Spark, but anyway, it's incredibly fast.

· 1.3 ألف likesOpen on X