Dữ liệu Jevals: điểm chuẩn độc lập cho TypeSafe Jev
Dữ liệu benchmark độc lập so sánh Jev (mô hình System One) của TypeSafe AI với nhiều LLM về điểm quyết định, độ chính xác, hiệu chỉnh, chi phí và độ trễ.
Một bản tái tạo tối thiểu mang tính thử nghiệm của mô hình quyết định Jev đóng của TypeSafe, với huấn luyện, đánh giá và API phục vụ. Nó sử dụng một đầu con trỏ trên các trạng thái ẩn để đọc xác suất lựa chọn và trả lời các câu hỏi định kiểu.
该仓库明确以TypeSafe AI的Jev/System One决策模型为主题,基于公开文档和黑盒探针研究进行假设性重建,实现了无解码循环的指针头架构,并提供训练、评估和服务API,属于实质性的实验研究。