stuntdouble: Оценка теневого прокси для Jev
Прокси на Node без зависимостей, который пересылает запросы к TypeSafe Jev, а локальные модели (Kev, Laya) параллельно принимают решения. Формирует отчёт о возможности замены.
OPEN SOURCE · CURATED REPOSITORIES
Curated Jev SDKs, tools, demos, integrations, benchmarks, and research projects. Repository metrics come from GitHub; titles, summaries, and categories are editorial.
По числу Stars на GitHub
По росту Stars и активности обновлений
Прокси на Node без зависимостей, который пересылает запросы к TypeSafe Jev, а локальные модели (Kev, Laya) параллельно принимают решения. Формирует отчёт о возможности замены.
Среда управления светофорами на основе CityFlow, которая оценивает контроллеры TypeSafe Jev и LLM-совместимые с OpenAI, а также базовые модели на основе правил и обучения с подкреплением через один и тот же конвейер моделирования.
CLI-инструмент, который читает журналы локальных сеансов кодирующих агентов и оценивает их с помощью Jev, модели System One от TypeSafe AI, создавая интерактивные HTML-отчёты и терминальные панели.
Вызывает модель Jev/System One от TypeSafe AI через официальный SDK, сравнивает её с LLM-заменителем на 24 операционных решениях и сохраняет воспроизводимые результаты и отчёты об оценке.
Инструмент CLI/оценки для TypeSafe Jev (System One): измеряет пороги, калибрует уверенность и проверяет дрейф на ваших данных, с опциональной разметкой от LLM-учителя. Включает демо-симулятор без ключа и реальную интеграцию с Jev API.
Предварительно зарегистрированный аудит Jev от TypeSafe AI на испанском языке — точность, калибровка и стоимость токенов — плюс CLI для запуска того же сравнения на ваших размеченных данных.
Открытая локальная альтернатива модели Jev System One от TypeSafe, предоставляющая типизированные решения с калиброванной уверенностью. Включает межсистемный сравнительный тест с Jev и другими локальными моделями.
Три измеренных эксперимента по галлюцинациям в RAG: проверка цитат, Jev от TypeSafe и STAIR от IBM. Более 850 оцененных вопросов, необработанные ответы включены.
Journey Evals — это инструмент оценки, который проводит реальный браузер или агента LangGraph по объявленным пользовательским сценариям и проверяет результаты с помощью серверных доказательств; для управления и выбора элементов используется Jev от TypeSafe.
Открытый инструмент анализа контента и LLM-оценки, который оценивает публикации с помощью калиброванных суждений TypeSafe Jev (System One) и проверяет их на реальных данных вовлечённости.
Код и исходные данные проекта Lunar Terminal: боты Robocode Tank Royale, GapFlap, прокси для учёта токенов и рандомизированное испытание TypeSafe Jev с 327 решениями.
Навык агента для Claude Code, Codex и Cursor: сканирует репозиторий или идею, проверяет пригодность Jev и режимы отказов, оценивает стоимость/задержку и запускает живой пилот через API TypeSafe.