Back to explore

Агенты принятия решений Jev и проблема оценки

В посте отмечается, что Jev принимает решения, а не генерирует текст — например, вызывает инструменты, повторяет попытки, маршрутизирует или эскалирует, — и утверждается, что оценка надёжности автономных решений является новой задачей.

@typesafeai Jev makes decisions instead of generating text: which tool to call, whether to retry, route or escalate Interesting direction for agents. Because once software makes millions of these decisions autonomously, “valid output” ≠ reliable decision. That’s an eval problem!

Агенты принятия решений Jev и проблема оценки 1
· 1 likesOpen on X