Jevals 데이터: TypeSafe Jev 독립 벤치마크
TypeSafe AI의 Jev(System One 모델)와 여러 LLM을 결정 점수, 정확도, 보정, 비용, 지연 시간 측면에서 비교하는 독립적인 벤치마크 데이터입니다.
100CC-BY-4.0
TypeSafe의 Jev(System One 모델)에 대한 실습 연구 랩입니다. Noul/Choice/Score 프리미티브의 재현 가능한 벤치마크, 신뢰도 게이팅, 팬아웃 지연 시간, 에이전트 제어, 그리고 Jev 생태계에 대한 지속적인 감사를 제공합니다.
仓库 llt22/jev-lab 以 TypeSafe Jev / System One 模型为核心,包含可复现基准测试(Noul/Choice/Score、置信度门控、扇出延迟等)、SDK/集成列表、研究档案和社区审计,实质内容充分,属于深入研究项目。