Back to explore

Compartiendo evaluación de estabilidad de traducción multilingüe del modelo Jev

El autor probó previamente la traducción multilingüe de LLM con Qwen 3.6, que requería múltiples evaluaciones por la alta variabilidad. Tras cambiar a Jev, la variabilidad fue mínima, por lo que bastó una sola evaluación. Ejemplo: 7.5M tokens, $0.3165, 5m23s.

LLMの英語からの多言語翻訳能力のテストは、今までQwen 3.6で評価していましたが、揺れが大きく、温度0だとその1つを固定することになるので、3回評価の中央値を使っていました。 Jevは揺れが誤差程度だったので、1回評価で作り直しました。 7.5Mtok, $0.3165, 5分23秒 https://github.com/7shi/multilingual-reader/blob/main/examples/tr/README.md…

Compartiendo evaluación de estabilidad de traducción multilingüe del modelo Jev 1
· 2 likesOpen on X