返回探索

用 LoRA 将 Qwen 与 LFM 模型 Jev 化

作者尝试用 LoRA 对 Qwen3.5-9B、Qwen3-VL-4B 和 LFM2.5-VL-3B 进行 Jev 化,指出 Qwen3.5-9B 准确率接近 Jev,但本地推理延迟随 token 长度变化,与 Jev API 稳定的 300ms 差距明显。

I've tried Jev-ifying Qwen3.5-9B, Qwen3-VL-4B, and LFM2.5-VL-3B using LoRA 1. In terms of scores, Qwen3.5-9B achieves accuracy that's almost on par with Jev. 2. Compared to the stable 300ms of Jev API, locally there's a huge difference depending on token length (BF16) 3. In image

用 LoRA 将 Qwen 与 LFM 模型 Jev 化 1用 LoRA 将 Qwen 与 LFM 模型 Jev 化 2用 LoRA 将 Qwen 与 LFM 模型 Jev 化 3用 LoRA 将 Qwen 与 LFM 模型 Jev 化 4
· 0 次赞在 X 打开