k2-fsa/sherpa-onnx
Speech-to-text, text-to-speech, speaker diarization, speech enhancement, source separation, and VAD using next-gen Kaldi with onnxruntime without Internet connection. Support embedded systems, Android, iOS, HarmonyOS, Raspberry Pi, RISC-V, RK NPU, Axera NPU, Ascend NPU, x86_64 servers, websocket server/client, support 12 programming languages
О проекте
Набор офлайн-инструментов для обработки речи на базе next-gen Kaldi и onnxruntime: распознавание и синтез речи, диаризация и идентификация говорящего, VAD, шумоподавление, разделение источников и keyword spotting. Работает на серверах, мобильных и встраиваемых устройствах без интернета.
Чем пригодится
- Добавить офлайн-распознавание речи в Android- или iOS-приложение через готовые биндинги
- Сделать субтитры к видео с помощью встроенного ASR и расстановки пунктуации
- Запустить VAD и диаризацию на Raspberry Pi для разметки записей совещаний
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня уже 8 звёзд, к концу дня ожидается около 10.
- GitHub Trending C++ за день: #11, +25 звёзд.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 14 844
- Звёзд за сутки
- 10
- Форков
- 1 707
- Issues и pull requests
- 3 818
- Наблюдателей
- 121
- Язык
- C++
- Лицензия
- Apache-2.0
- Последний релиз
- v1.13.8 · 10 сентября 2026
- Создан
- 1 сентября 2022
- Последний коммит
- 17 сентября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Где замечен
- 18 сентября 2026GitHub Trending C++ за день: #11, +25 звёзд
Похожие проекты
-
8,6
TheoLeeCJ/SemIf
Открытая реализация интерфейса семантических решений в стиле Jev: читает вероятности типизированных опций напрямую из логитов 4B-модели без генерации текста. Работает на одной RTX 3090.
-
7,1
vinnylarouge/jevlike
Небольшая обучаемая модель, выбирающая один вариант из меняющегося списка текстовых опций за один проход — открытая альтернатива коммерческой Jev от TypeSafe. Для разработчиков, кому нужна быстрая классификация или…
-
6,9
Continuum-AI-Corp/OrcaBonsai-27B-Uncensored
Инструмент для отключения отказов у сжатой LLM Ternary Bonsai 2 27B во время инференса: проекция residual-потока убирает направление отказа без изменения или переквантования весов. Работает на Apple Silicon через MLX.
-
6,4
TianyuCodings/NanoJev
Реплика модели Jev на базе Qwen3-0.6B: выдаёт распределения вероятностей по кандидатам за один forward-проход без декодирования токенов, с пайплайном обучения и демо на играх (лабиринт, Snake).
-
6,3
zhengkid/Dream-RSI
Исследовательский проект о рекурсивном самоулучшении: история прошлых циклов поиска превращается в replay-симулятор, по которому оценивают и улучшают стратегии исследования. Код ещё готовится к публикации, доступны…
-
5,0
ekzhang/openjev-sglang
HTTP-сервер, реализующий API TypeSafe/Jev для структурированной классификации текста на базе Qwen3.6-35B-A3B и SGLang; возвращает вероятности ответов без генерации цепочки рассуждений.