Back to explore

Delar utvärdering av Jev-modellens flerspråkiga översättningsstabilitet

Författaren testade tidigare LLM:ers flerspråkiga översättning med Qwen 3.6, vilket krävde flera utvärderingar på grund av hög variation. Efter bytet till Jev var variationen minimal, så en enda utvärdering räckte. Exempel: 7,5M tokens, 0,3165 $, 5 min 23 sek.

LLMの英語からの多言語翻訳能力のテストは、今までQwen 3.6で評価していましたが、揺れが大きく、温度0だとその1つを固定することになるので、3回評価の中央値を使っていました。 Jevは揺れが誤差程度だったので、1回評価で作り直しました。 7.5Mtok, $0.3165, 5分23秒 https://github.com/7shi/multilingual-reader/blob/main/examples/tr/README.md…

Delar utvärdering av Jev-modellens flerspråkiga översättningsstabilitet 1
· 2 likesOpen on X