stuntdouble: Оцінка тіньового проксі для Jev
Проксі на Node без залежностей, який пересилає запити до TypeSafe Jev, а локальні моделі (Kev, Laya) паралельно приймають рішення. Формує звіт про можливість заміни.
OPEN SOURCE · CURATED REPOSITORIES
Curated Jev SDKs, tools, demos, integrations, benchmarks, and research projects. Repository metrics come from GitHub; titles, summaries, and categories are editorial.
За кількістю GitHub Stars
За приростом Stars й активністю оновлень
Проксі на Node без залежностей, який пересилає запити до TypeSafe Jev, а локальні моделі (Kev, Laya) паралельно приймають рішення. Формує звіт про можливість заміни.
Фреймворк керування світлофорами на основі CityFlow, який оцінює контролери TypeSafe Jev та LLM-сумісні з OpenAI разом із базовими моделями на основі правил і навчання з підкріпленням через той самий конвеєр моделювання.
CLI-інструмент, який читає журнали локальних сеансів кодувальних агентів і оцінює їх за допомогою Jev, моделі System One від TypeSafe AI, створюючи інтерактивні HTML-звіти та термінальні панелі.
Викликає модель Jev/System One від TypeSafe AI через офіційний SDK, порівнює її з LLM-замінником на 24 операційних рішеннях і фіксує відтворювані результати та звіти оцінювання.
Інструмент CLI/оцінювання для TypeSafe Jev (System One): вимірює пороги, калібрує впевненість і перевіряє дрейф на ваших даних, з опційною розміткою від LLM-учителя. Включає демо-симулятор без ключа та реальну інтеграцію з Jev API.
Попередньо зареєстрований аудит Jev від TypeSafe AI іспанською мовою — точність, калібрування та вартість токенів — плюс CLI для запуску того самого порівняння на ваших розмічених даних.
Відкрита локальна альтернатива моделі Jev System One від TypeSafe, що надає типізовані рішення з каліброваною впевненістю. Включає міжсистемний порівняльний тест з Jev та іншими локальними моделями.
Три виміряні експерименти щодо галюцинацій у RAG: перевірка цитат, Jev від TypeSafe та STAIR від IBM. Понад 850 оцінених запитань, необроблені відповіді включено.
Journey Evals — це інструмент оцінювання, який проводить реальний браузер або агента LangGraph через оголошені сценарії користувача та перевіряє результати за допомогою серверних доказів; для керування та вибору елементів використовує Jev від TypeSafe.
Інструмент з відкритим кодом для аналізу контенту та LLM-оцінювання, який оцінює публікації за каліброваними судженнями TypeSafe Jev (System One) і перевіряє їх на реальних даних залученості.
Код і сирі дані за Lunar Terminal: боти Robocode Tank Royale, GapFlap, проксі для обліку токенів і рандомізоване випробування TypeSafe Jev із 327 рішеннями.
Навичка агента для Claude Code, Codex і Cursor, яка сканує репозиторій або ідею, перевіряє придатність Jev і режими збоїв, оцінює вартість/затримку та запускає живий пілот через API TypeSafe.