Back to explore

تجربة Jev مقابل ستة نماذج لغوية في لعبة الثعبان

أجرى المؤلف لعبة الثعبان لمدة 60 ثانية مع Jev وستة نماذج لغوية بنفس البذرة ومساحة قرار رباعية الاتجاهات؛ سجل Jev 21 نقطة مع 204 قرارات.

“Models have been superhuman at chat for years. So where is all the automation?” I took @CompleteSkeptic’s question literally and built a small experiment. Jev vs. six LLMs playing Snake. Same seed, same four-way decision space, 60 seconds each. Jev: 21 pts / 204 decisions

· 0 likesOpen on X