Back to explore

Dando olhos a Jev: OCR local primeiro, depois entregar

Discussão sobre um padrão para dar visão a Jev no design de agentes: em vez de anexar visão a um modelo de decisão, executar OCR local primeiro para extrair texto estruturado e objetos e depois entregar a Jev.

Keno's breakdown of giving Jev eyes is a small example of a much bigger pattern in agent design. Jev can't see images. So the fix isn't to bolt vision onto a decision model, it's to run local OCR first, pull structured text and objects out of the picture, and only then hand Jev

· 0 likesOpen on X