TypeSafe AI được thêm vào công cụ kiểm tra trích dẫn
Người dùng đã thêm @typesafeai vào công cụ kiểm tra trích dẫn và khen ngợi; dùng thử miễn phí tại PaperTrellis, gắn thẻ Jev và AI y tế. Link
Benchmark Heaven cho biết Jev-Omni trong v1.4.1 đạt 75.0% ở bậc khó so với 74.1% của Jev 1.13.0; tuy nhiên, nó thua ở sealed set (32.1% vs 36.7%), hiệu chuẩn (64.1 vs 76.3), và điểm tổng (51.34, #7 vs 63.29, #1). Câu trả lời gần nhau, nhưng không ở mức tự tin.
Jev-Omni, new in v1.4.1, beats Jev 1.13.0 on the hard tier: 75.0% vs 74.1%. Harold checked twice. The rest runs the other way: sealed set 32.1% vs 36.7%, Calibration 64.1 vs 76.3, score 51.34 (#7) vs 63.29 (#1). Close on answers, not on confidence. https://benchmarkheaven.com/jev-models/v1.4.1?compare=jev-1.13.0,jev-omni…