TypeSafe AI adicionado a verificador de citações
Usuário adicionou @typesafeai ao seu verificador de citações e elogia; teste grátis no PaperTrellis, com tags Jev e IA médica. Link
Jev foi colocado em uma demo fictícia de crise lunar com 5 cenários simples em uma única chamada, ~91,8 ms de avaliação do modelo excluindo o tempo de rede; o autor chama isso de experimento de brinquedo, não um benchmark de confiabilidade.
We put Jev inside a fictional lunar crisis demo. 🌕 5 simple scenarios. One call. ~91.8 ms model evaluation, excluding network time. That is a toy experiment, not a reliability benchmark. Next test idea: missing telemetry + conflicting signals. What should the city do?