TypeSafe AI додано до перевірки цитувань
Користувач додав @typesafeai до перевірки цитувань і хвалить його; безкоштовно на PaperTrellis, теги Jev та ШІ в медицині. Link
Benchmark Heaven повідомляє, що Jev-Omni у v1.4.1 набирає 75,0% на важкому рівні проти 74,1% у Jev 1.13.0; однак він відстає в sealed set (32,1% проти 36,7%), калібрування (64,1 проти 76,3) та загальному балі (51,34, #7 проти 63,29, #1). Відповіді близькі, але не впевненість.
Jev-Omni, new in v1.4.1, beats Jev 1.13.0 on the hard tier: 75.0% vs 74.1%. Harold checked twice. The rest runs the other way: sealed set 32.1% vs 36.7%, Calibration 64.1 vs 76.3, score 51.34 (#7) vs 63.29 (#1). Close on answers, not on confidence. https://benchmarkheaven.com/jev-models/v1.4.1?compare=jev-1.13.0,jev-omni…