Back to explore

Delen van evaluatie van meertalige vertaalstabiliteit van Jev-model

De auteur testte eerder de meertalige vertaling van LLM's met Qwen 3.6, wat meerdere evaluaties vereiste vanwege grote variatie. Na de overstap naar Jev was de variatie minimaal, dus één evaluatie volstond. Voorbeeld: 7,5M tokens, $0,3165, 5 minuten 23 seconden.

LLMの英語からの多言語翻訳能力のテストは、今までQwen 3.6で評価していましたが、揺れが大きく、温度0だとその1つを固定することになるので、3回評価の中央値を使っていました。 Jevは揺れが誤差程度だったので、1回評価で作り直しました。 7.5Mtok, $0.3165, 5分23秒 https://github.com/7shi/multilingual-reader/blob/main/examples/tr/README.md…

Delen van evaluatie van meertalige vertaalstabiliteit van Jev-model 1
· 2 likesOpen on X