Niko1221/Strata
Qwen3.8-Flash-Next (125B MoE) on a 12-24 GB NVIDIA GPU + 64 GB RAM: one-click install for Windows / Linux. Strata inference engine, OpenAI/Anthropic API on localhost, optional image input.
О проекте
Локальный движок инференса на C++, запускающий 125B MoE-модель Qwen3.8-Flash-Next на обычном ПК с одной NVIDIA GPU (12–24 ГБ) и 64 ГБ RAM, с OpenAI/Anthropic-совместимым API на localhost.
Чем пригодится
- Запустить приватный чат с большой моделью на своём ПК без отправки данных в облако
- Подключить локальную модель как OpenAI-совместимый провайдер к кодинг-агенту или скрипту
- Отправить скриншот или скан страницы в модель для распознавания через image input
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня уже 48 звёзд, к концу дня ожидается около 78.
- Всплеск держится 3 дня подряд — это не случайный выброс.
- Репозиторию 2 дня, а у него уже 83 звезды. Истории меньше двух недель, так что обычного темпа, с которым можно сравнить всплеск, у него ещё нет.
- Топ новых репозиториев за неделю: #176.
- Около 10 форков в сутки — код забирают себе.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 83
- Сегодня
- 48 · к вечеру ≈ 78
- Форков
- 9
- Issues и pull requests
- 11
- Наблюдателей
- 2
- Язык
- C++
- Последний релиз
- v0.1.2 · 25 сентября 2026
- Создан
- 24 сентября 2026
- Последний коммит
- 25 сентября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Где замечен
- 26 сентября 2026Топ новых репозиториев за неделю: #176
Похожие по описанию
-
1,0
AtomicBot-ai/Atomic-Chat
Десктопное приложение и локальный inference-движок для запуска открытых LLM (Llama, Gemma, Qwen, Mistral и др.) на своём компьютере с OpenAI-совместимым API на localhost:1337/v1.
-
2,5
incoai/splash
Локальный движок инференса LLM для Apple silicon, оптимизированный под конкретные модели: обслуживает OpenAI- и Anthropic-совместимые API для кодинг-агентов на одном Mac.
-
1,9
Neroued/ninfer
NInfer — это написанный с нуля движок инференса на C++/CUDA для моделей Qwen3.5 Dense и MoE на одной видеокарте NVIDIA RTX 5090. Он запускает текстовые, графические и видео-запросы через локальный CLI или HTTP API,…
-
3,3
architectds/collabosm
Набор скриптов для запуска модели Qwen3.8-Flash-Next (125B MoE) на одной Colab A100-80GB High-RAM с OpenAI-совместимым эндпоинтом и измеренной производительностью.
-
0,5
EricLBuehler/mistral.rs
Rust-движок для инференса LLM с автоматической загрузкой моделей, мультимодальностью (текст, изображения, видео, аудио), квантизацией и OpenAI/Anthropic-совместимым сервером.
-
1,0
APUS-AI-Lab/fast-browser-use
Локальный движок автоматизации браузера на базе Qwen3.5 через MLX или PyTorch: выбирает действия по видимым DOM-элементам одним forward pass вместо генерации текста. Работает офлайн, без облачных API.