Back to explore

Model Jev System One przewyższa GPT-6 Astra i Fable 5.1 w teście rozumienia

Angus przeprowadził benchmark nowego modelu Jev "System One Model" od @typesafeai na 28-pytaniowym teście rozumienia: Jev prowadzi z 100% dokładnością i 1,0 s, przed GPT-6 Astra i Fable 5.1, z GPT-4o mini jako kontrolą.

Benchmarked @typesafeai's new #Jev "System One Model" against GPT-6 Astra and Fable 5.1 on a 28-question comprehension test: 🥇 Jev: 100% accurate, 1.0s 🥈 Astra: 100%, 8.8s 🥉 Fable 5.1: 100%, 10.7s Added GPT-4o mini as a control: 4.1s, but made mistakes. What we building?

· 0 likesOpen on X