Back to explore

Jev-ification des modèles Qwen et LFM avec LoRA

L'auteur a testé la Jev-ification de Qwen3.5-9B, Qwen3-VL-4B et LFM2.5-VL-3B avec LoRA, notant que la précision de Qwen3.5-9B est presque équivalente à Jev, mais que la latence d'inférence locale varie avec la longueur des tokens, contrairement aux 300 ms stables de l'API Jev.

I've tried Jev-ifying Qwen3.5-9B, Qwen3-VL-4B, and LFM2.5-VL-3B using LoRA 1. In terms of scores, Qwen3.5-9B achieves accuracy that's almost on par with Jev. 2. Compared to the stable 300ms of Jev API, locally there's a huge difference depending on token length (BF16) 3. In image

Jev-ification des modèles Qwen et LFM avec LoRA 1Jev-ification des modèles Qwen et LFM avec LoRA 2Jev-ification des modèles Qwen et LFM avec LoRA 3Jev-ification des modèles Qwen et LFM avec LoRA 4
· 0 likesOpen on X