0xShug0/audio.cpp
An all-in-one, pure C++ inference engine for audio models, powered by ggml. Supports TTS, STT, VAD, voice conversion, music generation, and more, with highly optimized performance. No Python dependency.
О проекте
Нативный C++ движок для инференса аудиомоделей на базе ggml: TTS, распознавание речи, VAD, клонирование голоса, генерация музыки. Работает без Python на CPU, CUDA, ROCm, Vulkan и Metal.
Чем пригодится
- Запустить локальный TTS-сервер без Python-зависимостей на своём железе
- Сравнить несколько GGUF-вариантов моделей ASR бок о бок в Arena UI
- Развернуть распознавание речи на edge-устройстве через CPU-бэкенд
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня 32 звезды.
- GitHub Trending C++ за день: #4, +42 звезды.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 2 676
- Звёзд за сутки
- 32
- Форков
- 304
- Issues и pull requests
- 526
- Наблюдателей
- 26
- Язык
- C++
- Последний релиз
- v0.7.4 · 13 сентября 2026
- Создан
- 23 июня 2026
- Последний коммит
- 13 сентября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Где замечен
- 13 сентября 2026GitHub Trending C++ за день: #1, +42 звезды
Похожие проекты
-
7,3
multimodal-art-projection/YuE
YuE2 — модель генерации музыки: по тексту и описанию стиля строит редактируемый план мелодии и аккордов, затем рендерит полноценную песню с вокалом и аккомпанементом. Поддерживает zero-shot каверы и правку композиции…
-
5,9
debpalash/VoiceStudio
Локальная альтернатива ElevenLabs для клонирования и синтеза голоса, дубляжа видео, диктовки и создания аудиокниг на своём железе без аккаунтов и API-ключей. Поддерживает 16 TTS- и 11 ASR-движков, каталог из 646…
-
5,9
eternityspring/reelbench-skills
Набор skill-плагинов для Claude Code и Codex по работе с видео: video-shots разбирает готовый ролик на раскадровку по отдельным кадрам с метриками (длительность, план, движение камеры), video-sync собирает видео с…
-
4,6
Colafornia/short-video-generator-AI
Открытый инструмент, превращающий длинные YouTube-видео в вертикальные короткие клипы: сам находит яркие моменты, добавляет субтитры, перевод и озвучку. Альтернатива платным SaaS вроде OpusClip для создателей контента.
-
4,5
k2-fsa/OmniVoice
Многоязычная zero-shot TTS-модель с поддержкой 600+ языков, клонированием голоса и управлением атрибутами голоса. Работает на архитектуре в стиле diffusion language model с быстрым инференсом.
-
4,5
govin-ai/dunhuang-aura-skill
AI Skill для генерации и правки коммерческих визуалов в стиле дуньхуанской минеральной эстетики, работает в Codex, Claude Code и других средах с поддержкой SKILL.md.