Генерация медиа: что взлетает на GitHub
Самые быстрорастущие репозитории в категории «Генерация медиа»: описания на русском, сценарии применения и проверка звёзд. Обновление каждые 30 минут.
-
7,3
multimodal-art-projection/YuE
YuE2 — модель генерации музыки: по тексту и описанию стиля строит редактируемый план мелодии и аккордов, затем рендерит полноценную песню с вокалом и аккомпанементом. Поддерживает zero-shot каверы и правку композиции…
-
5,9
debpalash/VoiceStudio
Локальная альтернатива ElevenLabs для клонирования и синтеза голоса, дубляжа видео, диктовки и создания аудиокниг на своём железе без аккаунтов и API-ключей. Поддерживает 16 TTS- и 11 ASR-движков, каталог из 646…
-
5,9
eternityspring/reelbench-skills
Набор skill-плагинов для Claude Code и Codex по работе с видео: video-shots разбирает готовый ролик на раскадровку по отдельным кадрам с метриками (длительность, план, движение камеры), video-sync собирает видео с…
-
4,6
Colafornia/short-video-generator-AI
Открытый инструмент, превращающий длинные YouTube-видео в вертикальные короткие клипы: сам находит яркие моменты, добавляет субтитры, перевод и озвучку. Альтернатива платным SaaS вроде OpusClip для создателей контента.
-
4,5
k2-fsa/OmniVoice
Многоязычная zero-shot TTS-модель с поддержкой 600+ языков, клонированием голоса и управлением атрибутами голоса. Работает на архитектуре в стиле diffusion language model с быстрым инференсом.
-
4,5
govin-ai/dunhuang-aura-skill
AI Skill для генерации и правки коммерческих визуалов в стиле дуньхуанской минеральной эстетики, работает в Codex, Claude Code и других средах с поддержкой SKILL.md.
-
4,4
calesthio/OpenMontage
Открытая агентная система видеопроизводства: AI-ассистент по текстовому описанию проводит исследование, пишет сценарий, генерирует ассеты, монтирует и рендерит готовое видео. 12 пайплайнов, 100+ инструментов и 700+…
-
4,4
Vincentwei1021/anything2explainer
Скилл для Claude Code и Codex, превращающий тему или документ в объясняющее видео на чёрном фоне с закадровым голосом, субтитрами и прогресс-баром глав. Каждый кадр рисуется кодом на Remotion (React + TypeScript), без…
-
3,9
heygen-com/hyperframes
Фреймворк для превращения HTML, CSS, медиа и анимаций в детерминированные MP4-видео. Работает локально через CLI или из AI-агентов через набор skills.
-
3,8
jeremyipark/vision-demos
Набор демо-проектов компьютерного зрения на Python: сравнение синхронности танцоров, подсчёт подтягиваний и анализ бега по видео с помощью модели vitpose-plus-large.
-
2,9
EverettFish/holo-card-studio
Codex Skill, превращающий текстовое описание или референс в редактируемую 3D-карту для Blender и интерактивную страницу Three.js с параллаксом и голографическим блеском.
-
2,9
freestylefly/awesome-gpt-image-2
Библиотека промптов и шаблонов для генерации изображений в GPT-Image 2/2.5: 500+ разобранных кейсов, 20+ промышленных шаблонов и Skill для агентов, оформленных как Prompt-as-Code.
-
2,8
yang0/handraw-style
Библиотека из 261 нумерованного рукописного художественного стиля с двуязычными промптами: выбираете номер и тему, получаете готовые промпты на китайском и английском для генерации изображений. Помогает сохранять…
-
2,4
masihsultani/whiteboard-animator
CLI-инструмент на Python, превращающий готовую whiteboard-картинку в видео с эффектом рисования от руки: текст пишется по словам, контуры обводятся, заливки наносятся мазками. Работает на CPU без GPU и API-ключей.
-
2,4
0xShug0/audio.cpp
Нативный C++ движок для инференса аудиомоделей на базе ggml: TTS, распознавание речи, VAD, клонирование голоса, генерация музыки. Работает без Python на CPU, CUDA, ROCm, Vulkan и Metal.
-
2,3
basketikun/infinite-canvas
Открытая бесконечная канва-воркбенч для AI-творчества: генерация изображений и видео, редактирование по референсам, диалоговый ассистент, библиотека промптов и управление материалами в одном интерфейсе. Работает с…
-
2,3
yi1108/printfilm
Открытая AI-студия для создания коротких видео и эпизодических комиксов: от темы и сценария через раскадровку, генерацию изображений, видео и озвучки до финального монтажа. Включает пользовательский интерфейс,…
-
2,3
img2threejs/img2threejs
Инструмент, который по одному референсному изображению создаёт процедурную 3D-модель на Three.js в виде TypeScript-кода, с иерархией для анимации и контролем качества.
-
2,2
MiniMax-AI/MiniMax-H3
Omni-модальная генеративная система MiniMax H3: понимает текст, изображения, видео и аудио и генерирует видео со стереозвуком до 2K и 15 секунд. Репозиторий содержит набор скиллов для написания промптов и стилевой…
-
2,0
jub0t/Concat
Кроссплатформенный видеоредактор на Rust — свободная замена CapCut без водяных знаков, подписок и аккаунтов, работающая полностью локально. Поддерживает многодорожечный монтаж, автосубтитры, TTS и шаблоны.
-
1,9
s1dashu/ip-as-logo-skill
Agent Skill в открытом формате Agent Skills для генерации предельно простых округлых IP-маскотов-логотипов с доминирующей композицией в нижнем углу и сплошным именованным фоном. Работает с любым совместимым AI-агентом,…
-
1,8
helloianneo/ian-xiaohei-illustrations
Codex Skill, который превращает ключевые тезисы, процессы и метафоры из китайских статей в 16:9 иллюстрации на белом фоне в стиле ручной графики с персонажем «Сяо Хэй» и короткими красно-оранжево-синими подписями.
-
1,8
dsp56300/gearmulator
Эмулятор IC-чипов (DSP56300 и др.) для запуска оригинальных прошивок классических VA-синтезаторов и эффектов конца 90-х/2000-х в виде аудиоплагинов VST3, AU, CLAP, LV2 и FST.
-
1,7
ooolabdev/ooosplat
Локальное десктопное приложение, превращающее видео или наборы изображений в 3D Gaussian Splats в один клик: само выполняет подготовку кадров, реконструкцию камеры в COLMAP и обучение в Brush.
-
1,7
facok/comfyui-SelfLift
Расширение для ComfyUI с прогрессивной генерацией: ранние шаги диффузии выполняются на низком разрешении, затем результат поднимается до полного. Реализует SelfLift-zero из статьи для rectified-flow моделей изображений…
-
1,5
HRuiCcc/RuiC-card-skill
Codex Skill, который по одному предложению или референс-картинке генерирует 3D-голографическую карточку: четырёхслойные изображения, Blender-сцену с параллаксом и одностраничный Three.js-просмотрщик.
-
1,5
peggykangkang02/xialingguo-ip
Набор шаблонов и Skill для генерации обложек статей (21:9 и другие пропорции) с真人 IP-персонажем, девятью визуальными стилями и автоматическим подбором композиции под заголовок и акцент материала.
-
1,5
ZzzLc0405/photo-abstract-editorial
Codex Skill и набор промптов, превращающие одну фотографию в вертикальную редакционную композицию: исходный снимок сверху, абстрактная панель снизу и поэтичный английский заголовок. Не фильтр и не стилизация —…
-
1,5
wide-trace/open-higgsfield
Открытая self-hosted студия для генерации изображений и видео через 32 модели (8 image, 24 video) в одном интерфейсе с единой строкой промпта, галереей и настройками под каждую модель.
-
1,4
opentoonz/opentoonz
OpenToonz — открытая программа для создания 2D-анимации, основанная на версии Toonz, доработанной Studio Ghibli. Подходит аниматорам и студиям для покадровой и векторной анимации.
-
1,4
Zeejay0/gathered-scenes-zine-skill
Набор Skill-ов для Codex, превращающих обычные фотографии в страницы журнала: либо коллаж с сохранением реального снимка, либо дистилляция сцены в самостоятельную иллюстрацию.
-
1,3
diffusionstudio/lottie
Фреймворк для генерации готовых к продакшену Lottie-анимаций с помощью кодинг-агентов (Claude Code, Codex) через skill text-to-lottie. Агент создаёт сцены в проекте, а встроенный плеер показывает их в реальном времени.
-
1,3
circle-group/hktex
HKTex — внутреннее (intrinsic) представление текстур для треугольных мешей без UV-развёртки: внешний вид задаётся анизотропными heat kernel'ами прямо на поверхности. Позволяет подгонять текстуру из готового меша или…
-
1,2
yanliudesign/mono-color-skill
Навык для AI-агентов, генерирующий редакционные изображения в стиле одно- или двухцветной печати: постеры, зины, упаковка, портреты. Сохраняет визуальную систему, а не копирует референс.
-
1,2
LiamGvchi/gc-minimal-zine-poster
Codex-скилл, превращающий тему, фразу или фотографию в минималистичный зиновый постер с бумажной текстурой и готовый промпт для генерации изображения. Работает как набор правил и рецептов внутри Codex без скриптов и…
-
0,7
GangTailorUpgrade/undress-service
Self-hosted AI-сервис для оцифровки гардероба: загружает фото одежды, автоматически тегирует вещи через CLIP и генерирует образы с помощью Stable Diffusion/FLUX. Предназначен для людей, желающих приватно управлять…
-
0,5
cclank/lanshu-create-ai-presenter-video
Codex Skill для создания цифровых ведущих видео: из темы или сценария и авторизованного фото человека собирает озвучку, генерацию персонажа, липсинк, субтитры и монтаж с проверкой качества.
-
0,4
LerSent001/holo-card
Codex-скилл и локальный API для превращения изображения в интерактивную голографическую карту с параллаксом переднего плана, движущимся фоном и настраиваемым свечением контура.