openlayer-ai/jevals
Agent evals and guardrails in one request. Built on Jev, Kev and Laya.
О проекте
Библиотека для оценки и защиты AI-агентов: вместо LLM-судьи использует типизированные вопросы к моделям Jev/Kev/Laya, возвращая вероятности за один запрос. Позволяет проверять каждый трейс быстро и дёшево, в том числе внутри цикла агента.
Чем пригодится
- Прогнать метрики Grounded, AnswerRelevancy и PHI по трейсу агента одним запросом
- Поставить gate внутри цикла агента, чтобы блокировать ответы вне области или с утечкой PHI
- Сравнить выбор инструмента агентом с ожидаемым через ToolChoice и UsedToolResult
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня уже 0 звёзд, к концу дня ожидается около 4.
- Репозиторию 1 день, а у него уже 4 звезды.
- Hacker News: «Show HN: jevals – replacing LLM judges with typed Jev decisions» — 11 очков, 5 ч назад.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 4
- Звёзд за сутки
- 4
- Форков
- 0
- Issues и pull requests
- 0
- Наблюдателей
- 0
- Язык
- Python
- Лицензия
- MIT
- Последний релиз
- v0.1.1 · 20 сентября 2026
- Создан
- 20 сентября 2026
- Последний коммит
- 20 сентября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Обсуждения на Hacker News
- Show HN: jevals – replacing LLM judges with typed Jev decisions11 очков, 20 сентября 2026
Где замечен
- 21 сентября 2026Замечен на Hacker News
Похожие проекты
-
9,2
NandhaKishorM/laya
Laya — неавторегрессивный движок принятия решений: за один forward pass (~35 мс на GPU) отвечает на типизированные вопросы (choice, score, noul) по любому состоянию (текст, письмо, тикет, JSON) с калиброванными…
-
9,1
zai-org/ZCode
AI-агент для программирования от Z.ai: рабочее место с десктопным приложением на Electron, веб-интерфейсом и терминальным Agent CLI. Исходники клиента, бэкенда, общего UI и рантайма агента.
-
8,6
browser-use/jev-ultrafast
Браузерный агент с динамическим индексированным пространством действий: по одной цели на естественном языке выбирает операцию (CLICK, TYPE_TEXT, SELECT и др.) и элемент, а текст генерирует небольшая LLM только при вводе.
-
7,4
trycua/cua
Набор открытых инструментов для computer-use агентов: облачные и локальные десктопы, драйвер автоматизации приложений и бенчмарки для обучения и оценки. Нужен тем, кто даёт AI-агентам управлять компьютером.
-
7,2
typesafe-ai/skills
Набор agent skills для работы с API System One от TypeSafe: типизированные решения и вероятности для LLM-агентов. Устанавливается как плагин Claude Code или через skills.sh.
-
7,0
vercel-labs/json-render
Фреймворк генеративного UI: LLM создаёт интерфейсы из промпта в виде JSON по заданному каталогу компонентов, что делает вывод предсказуемым и безопасным. Поддерживает React, Vue, Svelte, Solid, React Native, Next.js,…