TypeSafe AI adicionado a verificador de citações
Usuário adicionou @typesafeai ao seu verificador de citações e elogia; teste grátis no PaperTrellis, com tags Jev e IA médica. Link
O autor relata que a média de 8 permutações das saídas do Qwen reduz o erro KL em cerca de 79%, e todas as 720 permutações em cerca de 97%, enquanto Jev mostra apenas uma melhoria ligeira.
If Qwen favors the first option, let every answer take a turn there—then average the probabilities. Averaging 8 permutations reduced its KL error by ~79%; all 720 reduced it by ~97%, relative to average single-order error. Jev improved only slightly.