# NVIDIA/Model-Optimizer > Библиотека NVIDIA для сжатия и ускорения моделей: квантизация, прунинг, дистилляция, NAS и speculative decoding с экспортом в TensorRT-LLM, vLLM, SGLang. Для ML-инженеров, готовящих модели к деплою. - Магнитуда: 2,7 из 10 — Взлёт - Звёзды: 3 902 всего · +36 звёзд сегодня, к вечеру ≈ 56 - Доверие к звёздам: рост звёзд выглядит естественно - Категория: Языковые модели · Язык: Python · Лицензия: Apache-2.0 · Создан: 2024-04-23 · Последний коммит: 2026-09-24 - GitHub: https://github.com/NVIDIA/Model-Optimizer · Сайт: https://nvidia.github.io/Model-Optimizer/ · Страница: https://gitnova.dev/r/NVIDIA/Model-Optimizer ## Чем пригодится - Квантизовать LLM в FP8 или NVFP4 для ускорения инференса в vLLM - Сжать модель через pruning и distillation, сохранив качество - Экспортировать оптимизированный чекпоинт в TensorRT-LLM или SGLang ## Почему он здесь - Сегодня уже 36 звёзд, к концу дня ожидается около 56. Обычный темп — 10 в день, сейчас в 5,7 раза больше. - За последние двое суток темп в 6,4 раза выше, чем в предыдущие полторы недели. - GitHub Trending за день: #5, +22 звезды. - GitHub Trending Python за день: #3, +22 звезды. ## Доверие к звёздам Рост звёзд выглядит естественно. Метки доверия к звёздам — эвристики по поведению репозитория, а не проверка каждого, кто поставил звезду. ## Цифры - Форков: 621 - Issues и pull requests: 2 523 - Наблюдателей: 32 - В среднем за неделю: 15 в день - Обычный темп: 10 в день - Звёзд за последний час (по замерам): 17 - Последний релиз: 0.47.0 (2026-09-23) ## Звёзды по дням за 30 дней (от старых к новым, сегодня — неполный день) 2026-08-26 … 2026-09-24: 7, 9, 32, 65, 35, 32, 22, 29, 17, 14, 6, 7, 5, 10, 8, 6, 7, 5, 6, 10, 5, 5, 5, 3, 5, 8, 7, 4, 21, 36 ## Где замечен сейчас - GitHub Trending за день: #5, +22 звезды - GitHub Trending Python за день: #3, +22 звезды ## Похожие по описанию 1. **microsoft/onnxruntime** — 1,6 · Ровно · Языковые модели · C++ · +2 звезды сегодня, к вечеру ≈ 6 Кроссплатформенный ускоритель инференса и обучения ML-моделей. Запускает модели из PyTorch, TensorFlow, scikit-learn и других через формат ONNX с оптимизацией графа и аппаратным ускорением. Полная карточка: https://gitnova.dev/r/microsoft/onnxruntime.md 2. **NVIDIA/TensorRT-LLM** — 1,6 · Ровно · Языковые модели · Python · +3 звезды сегодня, к вечеру ≈ 6 Библиотека NVIDIA для оптимизации инференса больших языковых моделей и визуальных генеративных моделей на GPU: Python API, специализированные ядра и эффективный рантайм на C++/Python. Полная карточка: https://gitnova.dev/r/NVIDIA/TensorRT-LLM.md 3. **MiaAI-Lab/DeepSeek-v4.1-Flash-EXL3-2x-DGX-Sparks** — 1,1 · Остывает · Языковые модели · Python · +2 звезды сегодня, к вечеру ≈ 4 Локальный чекпоинт DeepSeek-V4.1-Flash в квантовании EXL3 2.9 bpw (196 GiB, 39 шардов) для запуска через vLLM с OpenAI-совместимым API на двух NVIDIA GB10 (DGX Spark) с tensor-parallel 2. Включает спекулятивное декодирование DSpark и… Полная карточка: https://gitnova.dev/r/MiaAI-Lab/DeepSeek-v4.1-Flash-EXL3-2x-DGX-Sparks.md 4. **hao-ai-lab/FastVideo** — 1,1 · Ровно · Генерация медиа · Python · +3 звезды сегодня, к вечеру ≈ 5 Фреймворк для ускоренной генерации видео: пост-тренировка (дистилляция, LoRA, sparse attention) и быстрый инференс диффузионных видеомоделей на GPU и Apple Silicon. Полная карточка: https://gitnova.dev/r/hao-ai-lab/FastVideo.md 5. **deepseek-ai/DeepSpec** — 1,4 · Ровно · Языковые модели · Python · +6 звёзд сегодня, к вечеру ≈ 10 Полный пайплайн для обучения и оценки draft-моделей speculative decoding: подготовка данных, обучение против кэша target-модели и замер acceptance на бенчмарках. Поддерживает алгоритмы DSpark, DFlash и Eagle3. Полная карточка: https://gitnova.dev/r/deepseek-ai/DeepSpec.md --- Магнитуда (0–10) — насколько быстро и необычно сейчас растёт интерес к репозиторию. Это не оценка качества. Дни — по UTC. «Уже сегодня» — факт, «к вечеру ≈» — прогноз. Описания и сценарии пишет модель (DeepSeek V4.1 Flash) по README, в деталях возможны ошибки: конкретные утверждения (замеры, скорость, железо) проверяйте в самом репозитории. Данные на 2026-09-24 13:15 UTC, обновление каждые 30 минут.