Jev startuje: model System One do decyzji
Założyciel TypeSafe, Diogo Almeida, przedstawia Jev, metodę trenowania RLCD i skupienie modelu na decyzjach w oprogramowaniu. Post zawiera film premierowy 2:56.

Angus przeprowadził benchmark nowego modelu Jev "System One Model" od @typesafeai na 28-pytaniowym teście rozumienia: Jev prowadzi z 100% dokładnością i 1,0 s, przed GPT-6 Astra i Fable 5.1, z GPT-4o mini jako kontrolą.
Benchmarked @typesafeai's new #Jev "System One Model" against GPT-6 Astra and Fable 5.1 on a 28-question comprehension test: 🥇 Jev: 100% accurate, 1.0s 🥈 Astra: 100%, 8.8s 🥉 Fable 5.1: 100%, 10.7s Added GPT-4o mini as a control: 4.1s, but made mistakes. What we building?