Back to explore

Jev ليس نموذجًا لغويًا كبيرًا: يعيد إجابات مُنمّطة واحتمالات، ويفوز في اختبار الاستشهادات

Jev ليس نموذجًا لغويًا كبيرًا؛ يعيد إجابة مُنمّطة واحتمالًا وليس نصًا. في 42 فحص استشهاد مقابل GPT-5.4 وSonnet 5 وGemini 3.1 Pro، فاز Jev في الجمل المنشورة الحقيقية بنسبة 77.8% مقابل 66.7% بتكلفة 1/50. يتضمن مستودع اختبار على GitHub.

Jev is not an LLM. It returns a typed answer and a probability, no text. 42 citation checks vs GPT-5.4, Sonnet 5 and Gemini 3.1 Pro. They won the easy half 100%. It won the real published sentences, 77.8% to 66.7%, at 1/50th the cost. https://github.com/TheWayWithin/jev-bench…

Jev ليس نموذجًا لغويًا كبيرًا: يعيد إجابات مُنمّطة واحتمالات، ويفوز في اختبار الاستشهادات 1
· 0 likesOpen on X