Back to explore

Berbagi evaluasi stabilitas terjemahan multibahasa model Jev

Penulis sebelumnya menguji kemampuan terjemahan multibahasa LLM dengan Qwen 3.6, yang memerlukan beberapa evaluasi karena variasinya tinggi. Setelah beralih ke Jev, variasinya hanya pada tingkat kesalahan, jadi satu evaluasi cukup. Contoh: 7,5M token, $0,3165, 5 menit 23 detik.

LLMの英語からの多言語翻訳能力のテストは、今までQwen 3.6で評価していましたが、揺れが大きく、温度0だとその1つを固定することになるので、3回評価の中央値を使っていました。 Jevは揺れが誤差程度だったので、1回評価で作り直しました。 7.5Mtok, $0.3165, 5分23秒 https://github.com/7shi/multilingual-reader/blob/main/examples/tr/README.md…

Berbagi evaluasi stabilitas terjemahan multibahasa model Jev 1
· 2 likesOpen on X