Jevals-Daten: unabhängiger Benchmark für TypeSafe Jev
Unabhängige Benchmark-Daten, die TypeSafe AIs Jev (System One Modell) mit mehreren LLMs in Entscheidungs-Score, Genauigkeit, Kalibrierung, Kosten und Latenz vergleichen.
Ein Lernprojekt, das einen Entscheidungs-Endpunkt im TypeSafe-Jev/System-One-Stil auf einem Qwen3-0.6B-Backbone mit LoRA implementiert, plus einen OpenAI-kompatiblen Chat-/Generierungsserver und eine MiniJev-kompatible Auswertung. Keine Produktionssoftware.
README 明确以 TypeSafe Jev/System One 的概念和 API 规范为基础,实现了 /v1/systemone 决策接口,并在 Qwen3-0.6B + LoRA 上进行训练、服务与评测,包含 MiniJev 对照和 holdout 结果,属于真实深入的研究/实验项目。