ninjahawk/livenerf
Benchmark for tracking model capability after release.
О проекте
Бенчмарк для отслеживания деградации frontier-моделей после релиза: ежедневно прогоняет фиксированный набор вопросов и статистически измеряет дрейф точности и токенов относительно базовой недели запуска.
Чем пригодится
- Запустить ежедневный прогон панели вопросов через headless Claude Code для сбора базовой линии
- Проверить, не упала ли точность модели за 10-дневное окно после релиза
- Отследить снижение числа выходных токенов как ранний признак снижения усилий модели
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня уже 0 звёзд, к концу дня ожидается около 30.
- Всплеск держится 3 дня подряд — это не случайный выброс.
- Репозиторию 6 дней, а у него уже 84 звезды. Истории меньше двух недель, так что обычного темпа, с которым можно сравнить всплеск, у него ещё нет.
- Топ новых репозиториев за неделю: #157.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 84
- Сегодня
- 0 · к вечеру ≈ 30
- Форков
- 4
- Issues и pull requests
- 5
- Наблюдателей
- 5
- Язык
- Python
- Создан
- 22 сентября 2026
- Последний коммит
- 27 сентября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Где замечен
- 28 сентября 2026Топ новых репозиториев за неделю: #157
Ещё в этой категории
-
6,9
Niko1221/Strata
Локальный движок инференса на C++, запускающий 125B MoE-модель Qwen3.8-Flash-Next на обычном ПК с одной NVIDIA GPU (12–24 ГБ) и 64 ГБ RAM, с OpenAI/Anthropic-совместимым API на localhost.
-
6,5
ollaya-dev/ollaya
Локальный рантайм для decision-моделей: скачивает и обслуживает модели классификации и маршрутизации через API, совместимый с TypeSafe. Аналог Ollama, но для моделей, возвращающих вероятности, а не текст.
-
6,3
deepfates/imp
Порт DSPy на BEAM: декларативные LM-программы на Elixir с сигнатурами, оптимизаторами и агентами, работающими как OTP-процессы.
-
4,7
Mapika/decider
Языковая модель, которая не генерирует текст, а за один forward pass возвращает калиброванные вероятности по типизированным вопросам (Choice, Score, Noul) о заданном состоянии. Открытое воспроизведение класса моделей…
-
4,6
NVIDIA/Model-Optimizer
Библиотека NVIDIA для сжатия и ускорения моделей: квантизация, прунинг, дистилляция, NAS и speculative decoding с экспортом в TensorRT-LLM, vLLM, SGLang. Для ML-инженеров, готовящих модели к деплою.
-
4,2
InternLM/Intern-Decision
Мультимодальная модель принятия решений на базе Qwen3.5: по состоянию, изображениям и типизированным вопросам (choice, score, yes/no) выдаёт решения с вероятностями. Включает обучение, два бэкенда инференса, калибровку…