# dchristopoulos/jev-aita > Бенчмарк, сравнивающий модель Jev от TypeSafe с Sonnet 5, GPT-5 nano и локальными LLM на 770 вердиктах Reddit r/AmItheAsshole по Brier score, задержке и стоимости. - Магнитуда: 1,2 из 10 — Тихо - Звёзды: 2 всего · +0 звёзд сегодня, к вечеру ≈ 0 - Доверие к звёздам: рост звёзд выглядит естественно - Категория: Языковые модели · Язык: Python · Создан: 2026-09-22 · Последний коммит: 2026-09-23 - GitHub: https://github.com/dchristopoulos/jev-aita · Страница: https://gitnova.dev/r/dchristopoulos/jev-aita ## Чем пригодится - Оценить калибровку и стоимость LLM на задаче предсказания вердиктов Reddit - Сравнить задержку и цену Jev с Sonnet 5 и GPT-5 nano на одном наборе постов - Воспроизвести методику бенчмарка для собственной модели или датасета ## Почему он здесь - Репозиторию 2 дня, а у него уже 2 звезды. Истории меньше двух недель, так что обычного темпа, с которым можно сравнить всплеск, у него ещё нет. - Hacker News: «Jev vs. LLMs on 770 "Am I the Asshole?" posts» — 22 очка, 1 день назад. ## Доверие к звёздам Рост звёзд выглядит естественно. Метки доверия к звёздам — эвристики по поведению репозитория, а не проверка каждого, кто поставил звезду. ## Цифры - Форков: 0 - Issues и pull requests: 1 - Наблюдателей: 0 - В среднем за неделю: 1 в день - Обычный темп: мало истории (меньше двух недель) - Звёзд за последний час (по замерам): 0 ## Звёзды по дням за 5 дней (от старых к новым, сегодня — неполный день) 2026-09-20 … 2026-09-24: 0, 0, 0, 2, 0 ## Hacker News - Jev vs. LLMs on 770 "Am I the Asshole?" posts — 22 очков, 5 комментариев: https://news.ycombinator.com/item?id=49821894 ## Где замечен сейчас - Замечен на Hacker News ## Похожие по описанию 1. **fstandhartinger/jevbench** — 2,4 · Ранний сигнал · Языковые модели · Python · +10 звёзд сегодня, к вечеру ≈ 12 Бенчмарк для Jev-подобных моделей принятия решений: модель получает состояние и рубрику, возвращает типизированный ответ с вероятностями. Оценивает точность, калибровку, скорость и стоимость. Полная карточка: https://gitnova.dev/r/fstandhartinger/jevbench.md 2. **vinilana/jev-eval-agent** — 0,1 · Остывает · AI-агенты · HTML · +0 звёзд сегодня, к вечеру ≈ 0 Исследовательский агент-ассистент на eve (Vercel) со 100 моковыми инструментами через OpenRouter, сравнивающий выбор инструмента самим LLM и классификатором Jev по числу шагов. Полная карточка: https://gitnova.dev/r/vinilana/jev-eval-agent.md --- Магнитуда (0–10) — насколько быстро и необычно сейчас растёт интерес к репозиторию. Это не оценка качества. Дни — по UTC. «Уже сегодня» — факт, «к вечеру ≈» — прогноз. Описания и сценарии пишет модель (DeepSeek V4.1 Flash) по README, в деталях возможны ошибки: конкретные утверждения (замеры, скорость, железо) проверяйте в самом репозитории. Данные на 2026-09-24 20:27 UTC, обновление каждые 30 минут.