Back to explore

Evaluación de Jev en ética: rendimiento comparable o ligeramente superior a Luna

Un usuario probó Jev en un benchmark de problemas éticos y lo comparó con Luna. La precisión es comparable o ligeramente superior; curiosamente, Luna tendía a elegir 'no puede determinar' cuando dudaba.

Jevは判断させるモデル、と言うことで倫理問題ベンチマークを試してみた 比較としてLunaも試したが、正解率は同等かやや上で良さげ 検証目的とは逸れるが、Luna が迷うと「判断できない」を選びがちだったのが興味深い

Evaluación de Jev en ética: rendimiento comparable o ligeramente superior a Luna 1
· 0 likesOpen on X