# Inferact/tpu-megakernels > Набор fused-мегакёрнелов для инференса языковых моделей на TPU: объединяют декодирование Kimi K3 и Qwen3.8-27B с спекулятивным декодированием в один кёрнел, давая ускорение относительно GB200 при батчах 1–8. - Магнитуда: 3,3 из 10 — Ранний сигнал - Звёзды: 95 всего · +0 звёзд сегодня, к вечеру ≈ 22 - Доверие к звёздам: рост звёзд выглядит естественно - Категория: Языковые модели · Язык: Python · Лицензия: Apache-2.0 · Создан: 2026-09-23 · Последний коммит: 2026-09-25 - GitHub: https://github.com/Inferact/tpu-megakernels · Страница: https://gitnova.dev/r/Inferact/tpu-megakernels ## Чем пригодится - Запустить OpenAI-совместимый сервер Qwen3.8-27B на одной хост-машине с восемью TPU для чат-инференса - Прогнать CPU-тесты корректности на 32 виртуальных устройствах без TPU - Оценить пропускную способность декодирования Kimi K3 с DSpark по сравнению с baseline ## Почему он здесь - Сегодня уже 0 звёзд, к концу дня ожидается около 22. - Всплеск держится 3 дня подряд — это не случайный выброс. - Репозиторию 2 дня, а у него уже 95 звёзд. Истории меньше двух недель, так что обычного темпа, с которым можно сравнить всплеск, у него ещё нет. - Топ новых репозиториев за неделю: #163. ## Доверие к звёздам Рост звёзд выглядит естественно. Метки доверия к звёздам — эвристики по поведению репозитория, а не проверка каждого, кто поставил звезду. ## Цифры - Форков: 2 - Issues и pull requests: 1 - Наблюдателей: 1 - В среднем за неделю: 39 в день - Обычный темп: мало истории (меньше двух недель) - Звёзд за последний час (по замерам): 0 ## Звёзды по дням за 6 дней (от старых к новым, сегодня — неполный день) 2026-09-20 … 2026-09-25: 0, 0, 0, 68, 27, 0 ## Где замечен сейчас - Топ новых репозиториев за неделю: #163 ## Похожие по описанию 1. **MiaAI-Lab/DeepSeek-v4.1-Flash-EXL3-2x-DGX-Sparks** — 1,1 · Остывает · Языковые модели · Python · +0 звёзд сегодня, к вечеру ≈ 3 Локальный чекпоинт DeepSeek-V4.1-Flash в квантовании EXL3 2.9 bpw (196 GiB, 39 шардов) для запуска через vLLM с OpenAI-совместимым API на двух NVIDIA GB10 (DGX Spark) с tensor-parallel 2. Включает спекулятивное декодирование DSpark и… Полная карточка: https://gitnova.dev/r/MiaAI-Lab/DeepSeek-v4.1-Flash-EXL3-2x-DGX-Sparks.md 2. **MiaAI-Lab/DeepSeek-v4.1-Flash-DGX-Sparks** — 2,1 · Ровно · Языковые модели · Python · +0 звёзд сегодня, к вечеру ≈ 7 Скрипты и патчи для запуска модели DeepSeek-V4.1-Flash через SGLang на кластере из 3–4 NVIDIA DGX Spark с MXFP4/FP8, спекулятивным декодированием и OpenAI-совместимым API. Полная карточка: https://gitnova.dev/r/MiaAI-Lab/DeepSeek-v4.1-Flash-DGX-Sparks.md --- Магнитуда (0–10) — насколько быстро и необычно сейчас растёт интерес к репозиторию. Это не оценка качества. Дни — по UTC. «Уже сегодня» — факт, «к вечеру ≈» — прогноз. Описания и сценарии пишет модель (DeepSeek V4.1 Flash) по README, в деталях возможны ошибки: конкретные утверждения (замеры, скорость, железо) проверяйте в самом репозитории. Данные на 2026-09-25 02:11 UTC, обновление каждые 30 минут.