Back to explore

Jev-ificação de modelos Qwen e LFM com LoRA

O autor testou a Jev-ificação de Qwen3.5-9B, Qwen3-VL-4B e LFM2.5-VL-3B com LoRA, observando que a precisão do Qwen3.5-9B é quase equivalente à do Jev, mas a latência de inferência local varia com o comprimento do token, ao contrário dos 300 ms estáveis da API Jev.

I've tried Jev-ifying Qwen3.5-9B, Qwen3-VL-4B, and LFM2.5-VL-3B using LoRA 1. In terms of scores, Qwen3.5-9B achieves accuracy that's almost on par with Jev. 2. Compared to the stable 300ms of Jev API, locally there's a huge difference depending on token length (BF16) 3. In image

Jev-ificação de modelos Qwen e LFM com LoRA 1Jev-ificação de modelos Qwen e LFM com LoRA 2Jev-ificação de modelos Qwen e LFM com LoRA 3Jev-ificação de modelos Qwen e LFM com LoRA 4
· 0 likesOpen on X