Data Jevals: tolok ukur independen untuk TypeSafe Jev
Data benchmark independen yang membandingkan Jev (model System One) dari TypeSafe AI dengan berbagai LLM dalam skor keputusan, akurasi, kalibrasi, biaya, dan latensi.
Rekonstruksi eksperimental minimal dari model keputusan Jev tertutup TypeSafe, dengan pelatihan, evaluasi, dan API penyajian. Ini menggunakan kepala penunjuk pada keadaan tersembunyi untuk membaca probabilitas opsi dan menjawab pertanyaan bertipe.
该仓库明确以TypeSafe AI的Jev/System One决策模型为主题,基于公开文档和黑盒探针研究进行假设性重建,实现了无解码循环的指针头架构,并提供训练、评估和服务API,属于实质性的实验研究。