Jev против моделей генерации текста
Jev не генерирует свободный текст. Сравнительное видео показывает различие между параллельным принятием решений и генерацией текста по токенам.

Обсуждается, что Jev не может придумать ответ вне предопределённой схемы, но всё ещё может выбрать неправильный ответ внутри неё, иногда с высокой уверенностью, и поднимаются вопросы оценки в сценариях с низким риском.
Jev is cool, but the question I’ve heard most over the past few days is: how do we evaluate its accuracy? 🤔 Jev cannot invent an answer outside a predefined schema, but it still can choose the wrong answer within it, sometimes even with high confidence. For low-stakes,