Back to explore

Jev tarzı yerel LLM motoru: yalnızca yargı için 40 ms çıkarım

Taro L. Saito, Jev gibi yerel bir LLM motorunun metin/JSON üretimini bırakıp yargıya odaklanarak DGX Spark üzerinde 40 ms çıkarım sağladığını belirtiyor.

Just like Jev, to think that a Local LLM engine capable of inference in 40ms is realized simply by abandoning text/json generation and specializing solely in judgment. It's running on DGX Spark, but anyway, it's incredibly fast.

· 1,3 B likesOpen on X