# NVIDIA/cutlass > CUTLASS — набор CUDA C++ шаблонов и Python DSL (CuTe DSL) для реализации высокопроизводительных операций линейной алгебры, в первую очередь GEMM, на GPU NVIDIA. Проект нужен исследователям и инженерам по производительности, пишущим оптимизированные ядра для Tensor Cores. - Магнитуда: 1,5 из 10 — Ровно - Звёзды: 10 474 всего · +6 звёзд сегодня, к вечеру ≈ 9 - Доверие к звёздам: рост звёзд выглядит естественно - Категория: Языковые модели · Язык: C++ · Создан: 2017-11-30 · Последний коммит: 2026-09-23 - GitHub: https://github.com/NVIDIA/cutlass · Сайт: https://docs.nvidia.com/cutlass/index.html · Страница: https://gitnova.dev/r/NVIDIA/cutlass ## Чем пригодится - Написать кастомное GEMM-ядро на CUDA C++ с нужными тайлами и типами данных - Собрать прототип ядра на CuTe DSL на Python без глубокого знания C++ - Запустить смешанную точность FP8/FP4 на Tensor Cores архитектур Hopper или Blackwell ## Почему он здесь - Сегодня уже 6 звёзд, к концу дня ожидается около 9. - GitHub Trending C++ за день: #15, +6 звёзд. - Среди свежих форков — заметные разработчики: @FindHao (325 подп.). ## Доверие к звёздам Рост звёзд выглядит естественно. Метки доверия к звёздам — эвристики по поведению репозитория, а не проверка каждого, кто поставил звезду. ## Цифры - Форков: 2 098 - Issues и pull requests: 3 314 - Наблюдателей: 121 - В среднем за неделю: 6 в день - Обычный темп: 6 в день - Звёзд за последний час (по замерам): 0 - Последний релиз: v4.8.0 (2026-09-22) ## Звёзды по дням за 30 дней (от старых к новым, сегодня — неполный день) 2026-08-25 … 2026-09-23: 9, 19, 12, 6, 11, 4, 6, 3, 9, 6, 3, 6, 6, 14, 2, 5, 7, 5, 4, 7, 1, 11, 4, 9, 3, 7, 4, 4, 3, 6 ## Где замечен сейчас - GitHub Trending C++ за день: #15, +6 звёзд ## Ещё в этой категории 1. **jaredpalmer/kev** — 9,0 · Взлёт · Языковые модели · Python · +464 звезды сегодня, к вечеру ≈ 1 121 kev — LoRA-адаптер с небольшим readout-хедом на базе Qwen2.5-0.5B, который за один forward pass отвечает на множество типизированных вопросов по документу, выдавая калиброванные вероятности вместо текста. Полная карточка: https://gitnova.dev/r/jaredpalmer/kev.md 2. **mizorewww/laya-mlx** — 7,1 · На пике · Языковые модели · Python · +134 звезды сегодня, к вечеру ≈ 464 Нативный MLX-рантайм для типизированных решающих моделей Laya: возвращает вероятности выбора, оценки или истинности без генерации текста, работает локально на Apple Silicon. Полная карточка: https://gitnova.dev/r/mizorewww/laya-mlx.md 3. **volotat/mini-AGI** — 6,8 · Ранний сигнал · Языковые модели · Python · +32 звезды сегодня, к вечеру ≈ 108 Байтовая языковая модель непрерывного обучения, которая сама собирает архитектуру, тренируется с нуля на одной GPU с 8 ГБ VRAM и продолжает учиться на всём, что читает. Эксперимент, показывающий, что continual learning без… Полная карточка: https://gitnova.dev/r/volotat/mini-AGI.md 4. **TheoLeeCJ/SemIf** — 6,4 · На пике · Языковые модели · Python · +68 звёзд сегодня, к вечеру ≈ 211 Открытая реализация интерфейса семантических решений в стиле Jev: читает вероятности типизированных опций напрямую из логитов 4B-модели без генерации текста. Работает на одной RTX 3090. Полная карточка: https://gitnova.dev/r/TheoLeeCJ/SemIf.md 5. **nokia-applied-research/AnyJev** — 6,2 · Ранний сигнал · Языковые модели · Python · +122 звезды сегодня, к вечеру ≈ 213 Превращает любую LLM в модель принятия решений с типизированными вопросами (выбор, да/нет, оценка), возвращающую реальные вероятности из распределения следующего токена, без обучения. L0 убирает позиционное и априорное смещение, L1… Полная карточка: https://gitnova.dev/r/nokia-applied-research/AnyJev.md --- Магнитуда (0–10) — насколько быстро и необычно сейчас растёт интерес к репозиторию. Это не оценка качества. Дни — по UTC. «Уже сегодня» — факт, «к вечеру ≈» — прогноз. Описания и сценарии пишет модель (DeepSeek V4.1 Flash) по README, в деталях возможны ошибки: конкретные утверждения (замеры, скорость, железо) проверяйте в самом репозитории. Данные на 2026-09-23 12:53 UTC, обновление каждые 30 минут.