Сейсмограф

Что набирает звёзды на GitHub прямо сейчас

NVIDIA/Model-Optimizer

A unified library of SOTA model optimization techniques like quantization, distillation, pruning, neural architecture search, speculative decoding, etc. It compresses deep learning models for downstream deployment frameworks like TensorRT-LLM, TensorRT, vLLM, etc. to optimize inference speed.

Языковые моделиPython
2,5 Взлёт Магнитуда из 10 — скорость роста интереса, а не оценка качества. Рост звёзд выглядит естественно. Данные на 24 сентября 2026, 12:27 UTC.
Открыть на Сейсмографе Открыть на GitHub

О проекте

Библиотека NVIDIA для сжатия и ускорения моделей: квантизация, прунинг, дистилляция, NAS и speculative decoding с экспортом в TensorRT-LLM, vLLM, SGLang. Для ML-инженеров, готовящих модели к деплою.

Чем пригодится

Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.

Почему он в тренде

Звёзды по дням

0408027 июня 202624 сентября 2026

Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.

Цифры

Всего звёзд
3 886
Сегодня
25 · к вечеру ≈ 42
Форков
621
Issues и pull requests
2 523
Наблюдателей
32
Язык
Python
Лицензия
Apache-2.0
Последний релиз
0.47.0 · 23 сентября 2026
Создан
23 апреля 2024
Последний коммит
24 сентября 2026

Доверие к звёздам

Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.

Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.

Где замечен

Поделиться

Бейдж для README

Вставьте в README — бейдж сам показывает свежую магнитуду и ведёт на эту страницу.

Сейсмограф: 2,5
[![Сейсмограф](https://gitnova.dev/badge/NVIDIA/Model-Optimizer.svg)](https://gitnova.dev/r/NVIDIA/Model-Optimizer)

Похожие по описанию

  1. 1,6
    microsoft/onnxruntime

    Кроссплатформенный ускоритель инференса и обучения ML-моделей. Запускает модели из PyTorch, TensorFlow, scikit-learn и других через формат ONNX с оптимизацией графа и аппаратным ускорением.

    РовноЯзыковые моделиC+++2 звезды сегодня, к вечеру ≈ 6

  2. 1,6
    NVIDIA/TensorRT-LLM

    Библиотека NVIDIA для оптимизации инференса больших языковых моделей и визуальных генеративных моделей на GPU: Python API, специализированные ядра и эффективный рантайм на C++/Python.

    РовноЯзыковые моделиPython+3 звезды сегодня, к вечеру ≈ 6

  3. 1,1
    MiaAI-Lab/DeepSeek-v4.1-Flash-EXL3-2x-DGX-Sparks

    Локальный чекпоинт DeepSeek-V4.1-Flash в квантовании EXL3 2.9 bpw (196 GiB, 39 шардов) для запуска через vLLM с OpenAI-совместимым API на двух NVIDIA GB10 (DGX Spark) с tensor-parallel 2. Включает спекулятивное…

    ОстываетЯзыковые моделиPython+2 звезды сегодня, к вечеру ≈ 4

  4. 1,1
    hao-ai-lab/FastVideo

    Фреймворк для ускоренной генерации видео: пост-тренировка (дистилляция, LoRA, sparse attention) и быстрый инференс диффузионных видеомоделей на GPU и Apple Silicon.

    РовноГенерация медиаPython+2 звезды сегодня, к вечеру ≈ 3

  5. 1,3
    deepseek-ai/DeepSpec

    Полный пайплайн для обучения и оценки draft-моделей speculative decoding: подготовка данных, обучение против кэша target-модели и замер acceptance на бенчмарках. Поддерживает алгоритмы DSpark, DFlash и Eagle3.

    РовноЯзыковые моделиPython+5 звёзд сегодня, к вечеру ≈ 9

  6. 3,0
    AlibabaResearch/SparkDiffusion

    Фреймворк для ускорения генерации видео на Diffusion Transformer моделях: сочетает разреженное low-rank внимание RoLa, дистилляцию CrossDistill и собственные операторы, давая 200×+ ускорение инференса для Wan 2.1/2.2.

    Ранний сигналГенерация медиаPython+7 звёзд сегодня, к вечеру ≈ 16