# Dreamer-Toby/STEPQuant > Метод пост-тренировочной квантизации рекуррентных состояний Delta-rule моделей: распределяет биты по юнитам состояния с учётом времени жизни ошибок и их влияния на выход. Нужен для снижения памяти при инференсе LLM с квантизованными состояниями. - Магнитуда: 0,5 из 10 — Ровно - Звёзды: 55 всего · +0 звёзд сегодня, к вечеру ≈ 2 - Доверие к звёздам: рост звёзд выглядит естественно - Категория: Языковые модели · Язык: Python · Создан: 2026-09-29 · Последний коммит: 2026-10-01 - GitHub: https://github.com/Dreamer-Toby/STEPQuant · Сайт: https://arxiv.org/abs/2609.38169 · Страница: https://gitnova.dev/r/Dreamer-Toby/STEPQuant ## Чем пригодится - Откалибровать план квантизации состояний для Qwen и запустить сервер через SGLang - Оценить точность long-generation задач при 4- и 6-битных состояниях против FP32 - Сравнить потребление памяти при квантизации состояний с INT8 и INT6 ## Почему он здесь - Сегодня уже 0 звёзд, к концу дня ожидается около 1. - Репозиторию 4 дня, а у него уже 55 звёзд. Истории меньше двух недель, так что обычного темпа, с которым можно сравнить всплеск, у него ещё нет. - Топ новых репозиториев за неделю: #198. ## Доверие к звёздам Рост звёзд выглядит естественно. Метки доверия к звёздам — эвристики по поведению репозитория, а не проверка каждого, кто поставил звезду. ## Цифры - Форков: 0 - Issues и pull requests: 0 - Наблюдателей: 0 - В среднем за неделю: 11 в день - Обычный темп: мало истории (меньше двух недель) - Звёзд за последний час (по замерам): 1 ## Звёзды по дням за 7 дней (от старых к новым, сегодня — неполный день) 2026-09-27 … 2026-10-03: 0, 0, 10, 26, 17, 2, 0 ## Где замечен сейчас - Топ новых репозиториев за неделю: #198 ## Ещё в этой категории 1. **Niko1221/Strata** — 8,1 · Взлёт · Языковые модели · C++ · +0 звёзд сегодня, к вечеру ≈ 1 164 Локальный движок инференса на C++, запускающий 125B MoE-модель Qwen3.8-Flash-Next на обычном ПК с одной NVIDIA GPU (12–24 ГБ) и 64 ГБ RAM, с OpenAI/Anthropic-совместимым API на localhost. Полная карточка: https://gitnova.dev/r/Niko1221/Strata.md 2. **StayLameBro/backburner** — 5,2 · Ранний сигнал · Языковые модели · Objective-C++ · +0 звёзд сегодня, к вечеру ≈ 73 Форк llama.cpp, который подключает iPhone по USB-C к Mac и распределяет работу: Mac считает слои 1-40, iPhone — 41-64 на своём GPU, что ускоряет prefill и позволяет держать контекст до 196k-229k токенов. Нужен тем, кто запускает Qwen3-27B… Полная карточка: https://gitnova.dev/r/StayLameBro/backburner.md 3. **Kutuyyy/Leaked-System-Prompt-AI** — 5,2 · Ранний сигнал · Языковые модели · +0 звёзд сегодня, к вечеру ≈ 63 Репозиторий собирает и документирует системные промпты, инструкции и определения инструментов крупных AI-моделей и агентских платформ (OpenAI, Anthropic, Google, Cursor, Devin и др.) для исследования их поведения. Полная карточка: https://gitnova.dev/r/Kutuyyy/Leaked-System-Prompt-AI.md 4. **Vibra-Ingenn/Janus** — 5,0 · Ранний сигнал · Языковые модели · Go · +0 звёзд сегодня, к вечеру ≈ 31 Локальный сервер LLM на Go: запускает .gguf-модели через llama.cpp (Vulkan или CPU) и отдаёт OpenAI-совместимый API с веб-интерфейсом и встроенными инструментами. Полная карточка: https://gitnova.dev/r/Vibra-Ingenn/Janus.md 5. **ninjahawk/livenerf** — 4,3 · Ранний сигнал · Языковые модели · Python · +0 звёзд сегодня, к вечеру ≈ 68 Бенчмарк для отслеживания деградации frontier-моделей после релиза: ежедневно прогоняет фиксированный набор вопросов и статистически измеряет дрейф точности и токенов относительно базовой недели запуска. Полная карточка: https://gitnova.dev/r/ninjahawk/livenerf.md --- Магнитуда (0–10) — насколько быстро и необычно сейчас растёт интерес к репозиторию. Это не оценка качества. Дни — по UTC. «Уже сегодня» — факт, «к вечеру ≈» — прогноз. Описания и сценарии пишет модель (DeepSeek V4.1 Flash) по README, в деталях возможны ошибки: конкретные утверждения (замеры, скорость, железо) проверяйте в самом репозитории. Данные на 2026-10-03 03:19 UTC, обновление каждые 30 минут.