Oruk-AI/orukeet
Orukeet: multilingual ASR with fitted, frozen Gabor kernels and native inference
О проекте
Многоязычный распознаватель речи на 25 языков, построенный на базе NVIDIA Parakeet TDT 0.6B v3 с заменой половины временных depthwise-фильтров энкодера на 12 288 обученных замороженных Gabor-ядер. Превосходит Parakeet по WER на 61 из 74 тестовых разбиений.
Чем пригодится
- Запустить локальную транскрипцию аудиофайлов через Python-пакет orukeet с автоустановкой runtime
- Подключить Orukeet как локальную модель распознавания речи в десктопном приложении OpenWhispr
- Развернуть постоянный воркер для пакетной транскрипции длинных записей с удержанием модели в памяти
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня уже 24 звезды, к концу дня ожидается около 42.
- За последние двое суток темп в 2,3 раза выше, чем в предыдущие полторы недели.
- Всплеск держится 3 дня подряд — это не случайный выброс.
- Репозиторию 5 дней, а у него уже 68 звёзд.
- Топ новых репозиториев за неделю: #172.
- Около 280 форков в сутки — код забирают себе.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 68
- Звёзд за сутки
- 42
- Форков
- 30
- Issues и pull requests
- 5
- Наблюдателей
- 3
- Язык
- Python
- Лицензия
- MIT
- Последний релиз
- v0.1.1 · 11 сентября 2026
- Создан
- 9 сентября 2026
- Последний коммит
- 12 сентября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Где замечен
- 14 сентября 2026Топ новых репозиториев за неделю: #172
Похожие проекты
-
7,0
JustVugg/colibri
Инференс-движок на чистом C без зависимостей для запуска больших MoE-моделей (744B–2.8T параметров) на потребительском железе за счёт многоуровневой памяти: VRAM, RAM и диск как единая иерархия для стриминга экспертов.
-
6,3
asgeirtj/system_prompts_leaks
Коллекция извлечённых системных промптов от Anthropic, OpenAI, Google, xAI и других — скрытых инструкций, которые получают чат-боты до первого сообщения пользователя.
-
5,6
huggingface/transformers
Фреймворк для определения и запуска предобученных ML-моделей (текст, зрение, аудио, мультимодальные) для инференса и обучения, совместимый с большинством тренировочных и инференс-движков.
-
4,9
unclecode/crawl4ai
Открытый веб-краулер и скрапер, преобразующий страницы в чистый Markdown, готовый для LLM, RAG и агентов. Работает через Python API, CLI и Docker без API-ключей.
-
4,8
MiaAI-Lab/DeepSeek-v4.1-Flash-EXL3-2x-DGX-Sparks
Локальный чекпоинт DeepSeek-V4.1-Flash в квантовании EXL3 2.9 bpw (196 GiB, 39 шардов) для запуска через vLLM с OpenAI-совместимым API на двух NVIDIA GB10 (DGX Spark) с tensor-parallel 2. Включает спекулятивное…
-
4,5
penberg/titania
Полный стек для запуска языковой модели Qwen3-0.6B: собственные GPU-ядра, компилятор, ISA, симулятор и планируемый RTL-GPU. Каждый слой написан с нуля и достаточно мал, чтобы один человек мог его прочитать.