Testes adicionais de labirinto para Jev
Com base no framework de testes de @karminski3, o autor adiciona vários resultados de Jev em problemas de labirinto e os compara com caminhada aleatória e algoritmos profissionais de labirinto.
THE JEV GUIDE · CURATED EDITION
Lançamentos, explicações, demos e projetos da comunidade sobre TypeSafe Jev, organizados por tema. Cada item aponta para sua fonte no X.
Seleção curada · Não exaustiva · Atualização manual
01 / EXPLORE
0 means awaiting a verified post
Com base no framework de testes de @karminski3, o autor adiciona vários resultados de Jev em problemas de labirinto e os compara com caminhada aleatória e algoritmos profissionais de labirinto.
O autor usou o novo modelo Jev da TypeSafe no Skills IL para construir uma ferramenta que detecta mensagens de phishing bancário recebidas por SMS, WhatsApp ou e-mail. Os usuários podem colar uma mensagem suspeita diretamente para verificação.
Alguém criou um diretório massivo sobre tudo relacionado a Jev, incluindo habilidades, repositórios, posts do X/Reddit, recursos, sites e muito mais, filtrável por caso de uso.
O autor sugere que os valores de retorno do Jev não devem ser tratados simplesmente como corretos; em vez disso, foque na confidence. Para tipos Choice, adicione uma opção cannot_tell para evitar erros.
O autor acha que Jev não é adequado para detectar conteúdo gerado por IA, todos os detectores de IA são semelhantes e inúteis a menos que a precisão seja superior a 90%, recomendando outra API. Link
O autor testou o Jev resolvendo um sudoku, notando que o prompt foi difícil mas rápido, e mencionou que LLMs supostamente têm dificuldade com sudoku.
O autor diz que o Jev 1.13 pode substituir grandes modelos de linguagem em algumas tarefas.
Rajeshsam observa que o impulso da IA parece ter voltado à ciência de dados tradicional com classificadores System 1 (como o Jev). Ele argumenta que respostas estruturadas tipadas e raciocínio determinístico em Python via hooks são melhores do que deixar o modelo adivinhar o fluxo de controle; deixe a ambiguidade na fronteira de ingestão.
Uma nova rodada comunitária mostra que Jev e GPT-5.4 são estatisticamente indistinguíveis (3,3 pontos), e Jev custa cerca de um quinquagésimo. Link
O desenvolvedor Tal Saiag compartilha um padrão Jev: cada chamada deixa deliberadamente um pequeno estado apenas para a próxima chamada, chamado de 'Jev carry state'.
Um usuário compartilha aprendizados de um experimento com Jev: requer prompts explícitos como modelos de nível GPT-4, é muito barato, e ele o ajustou por cerca de 8 horas com Astra.
Wildan twitta que está na hora de o Claude usar o Jev da TypeSafe AI.