Back to explore

Локальный LLM-движок в стиле Jev: вывод за 40 мс только для суждений

Taro L. Saito отмечает, что, как и Jev, локальный LLM-движок достигает вывода за 40 мс, отказавшись от генерации текста/JSON и специализируясь на суждениях, работая на DGX Spark.

Just like Jev, to think that a Local LLM engine capable of inference in 40ms is realized simply by abandoning text/json generation and specializing solely in judgment. It's running on DGX Spark, but anyway, it's incredibly fast.

· 1,3 тыс. likesOpen on X