leemysw/yovoice
Open-source voice creation for macOS and Windows. Local TTS, voice cloning, and emotion control — no cloud APIs or per-character fees.
О проекте
Локальный инструмент для macOS и Windows, превращающий текст в речь с клонированием голоса и управлением эмоциями без облачных API и оплаты за символы. Поддерживает несколько TTS-моделей (IndexTTS, VoxCPM2, OmniVoice, Qwen3-TTS) через audio.cpp.
Чем пригодится
- Сгенерировать озвучку текста локально с клонированием голоса из референсного клипа
- Настроить эмоции и стиль речи для нарратива или voiceover без облачных сервисов
- Поручить AI-агенту через CLI озвучить файл с текстом заданным голосом
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня уже 0 звёзд, к концу дня ожидается около 13.
- За последние двое суток темп в 2,4 раза выше, чем в предыдущие полторы недели.
- Всплеск держится 3 дня подряд — это не случайный выброс.
- Репозиторию 4 дня, а у него уже 58 звёзд.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 58
- Звёзд за сутки
- 13
- Форков
- 8
- Issues и pull requests
- 3
- Наблюдателей
- 1
- Язык
- TypeScript
- Лицензия
- Apache-2.0
- Последний релиз
- v0.1.2 · 18 сентября 2026
- Создан
- 15 сентября 2026
- Последний коммит
- 18 сентября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Где замечен
- 19 сентября 2026Топ новых репозиториев за неделю: #199
Похожие проекты
-
7,6
mcncarl/jianying-headless
Локальный инструмент автоматизации для Jianying Professional на macOS: строит нативные черновики из JSON-плана, редактирует копии существующих многодорожечных проектов и по запросу экспортирует MP4 через нативный…
-
6,3
wide-trace/open-higgsfield
Открытая self-hosted студия для генерации изображений и видео через 32 модели (8 image, 24 video) в одном интерфейсе с единой строкой промпта, галереей и настройками под каждую модель.
-
5,3
XGEN-Labs/XGEN-JING
XGEN-JING — эгоцентричная интерактивная модель на базе MiniMax-H3, которая по действиям, референсным изображениям и истории наблюдений генерирует видео и звук от первого лица для навигации, взаимодействия с объектами и…
-
4,4
inikolax/remiqora
Локальная студия генерации музыки на GPU, объединяющая ACE-Step 1.5 и YuE2-3B в одном Vue-интерфейсе с многодорожечным DAW, разделением на стемы, MIDI-транскрипцией и LoRA-дообучением.
-
4,2
kuhnhomeuk-cell/procedural-film
Agent skill, превращающий тему в 30-секундный вертикальный фильм: вся графика рисуется на canvas на чистом JavaScript, звук синтезируется через Web Audio, без медиафайлов. На выходе — один HTML-плеер и экспорт в MP4.
-
4,1
jtydhr88/music-composition-skills
Набор из 29 agent skills для Claude Code и OpenAI Codex, помогающих сочинять и аранжировать популярную музыку: из брифа агент собирает ARR-SPEC с тональностью, темпом, картой секций, гармонией и энергетической кривой.…