Back to explore

Agentes de decisão do Jev e o desafio de avaliação

O post observa que o Jev toma decisões em vez de gerar texto — como chamar ferramentas, tentar novamente, rotear ou escalar — e argumenta que avaliar decisões autônomas confiáveis é um novo desafio.

@typesafeai Jev makes decisions instead of generating text: which tool to call, whether to retry, route or escalate Interesting direction for agents. Because once software makes millions of these decisions autonomously, “valid output” ≠ reliable decision. That’s an eval problem!

Agentes de decisão do Jev e o desafio de avaliação 1
· 1 likesOpen on X