TypeSafe AI ajouté à un vérificateur de citations
L'utilisateur a ajouté @typesafeai à son vérificateur de citations et le trouve excellent ; essai gratuit sur PaperTrellis, tags Jev et IA médicale. Link
Benchmark Heaven rapporte que Jev-Omni dans v1.4.1 obtient 75,0 % sur le niveau difficile contre 74,1 % pour Jev 1.13.0 ; cependant, il est inférieur sur sealed set (32,1 % vs 36,7 %), calibration (64,1 vs 76,3) et score global (51,34, #7 vs 63,29, #1). Réponses proches, mais pas la confiance.
Jev-Omni, new in v1.4.1, beats Jev 1.13.0 on the hard tier: 75.0% vs 74.1%. Harold checked twice. The rest runs the other way: sealed set 32.1% vs 36.7%, Calibration 64.1 vs 76.3, score 51.34 (#7) vs 63.29 (#1). Close on answers, not on confidence. https://benchmarkheaven.com/jev-models/v1.4.1?compare=jev-1.13.0,jev-omni…