jingyaogong/minimind
🧠 Train a 64M-parameter LLM from scratch in just 2h!
О проекте
Учебный проект с открытым кодом для обучения сверхмалой языковой модели MiniMind (64M параметров) с нуля на PyTorch, включая полный цикл: pretrain, SFT, LoRA, RLHF, RLAIF и Tool Use.
Чем пригодится
- Обучить собственную мини-LLM с нуля на одной GPU за пару часов
- Изучить реализацию pretrain, SFT, LoRA и RLHF без обёрток transformers/trl
- Развернуть совместимый с OpenAI API сервер MiniMind для чат-интерфейсов
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня уже 82 звезды, к концу дня ожидается около 100.
- Интерес спадает: темп за двое суток — 47% от уровня предыдущих полутора недель.
- GitHub Trending за месяц: #15, +6 867 звёзд.
- Около 16 форков в сутки — код забирают себе.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 61 588
- Звёзд за сутки
- 100
- Форков
- 8 011
- Issues и pull requests
- 775
- Наблюдателей
- 278
- Язык
- Python
- Лицензия
- Apache-2.0
- Последний релиз
- v2 · 21 октября 2025
- Создан
- 27 июля 2024
- Последний коммит
- 18 сентября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Где замечен
- 18 сентября 2026GitHub Trending за месяц: #15, +6 867 звёзд
- 17 сентября 2026GitHub Trending за месяц: #16, +6 769 звёзд
- 16 сентября 2026GitHub Trending за месяц: #21, +6 660 звёзд
Похожие проекты
-
8,6
TheoLeeCJ/SemIf
Открытая реализация интерфейса семантических решений в стиле Jev: читает вероятности типизированных опций напрямую из логитов 4B-модели без генерации текста. Работает на одной RTX 3090.
-
7,1
vinnylarouge/jevlike
Небольшая обучаемая модель, выбирающая один вариант из меняющегося списка текстовых опций за один проход — открытая альтернатива коммерческой Jev от TypeSafe. Для разработчиков, кому нужна быстрая классификация или…
-
6,9
Continuum-AI-Corp/OrcaBonsai-27B-Uncensored
Инструмент для отключения отказов у сжатой LLM Ternary Bonsai 2 27B во время инференса: проекция residual-потока убирает направление отказа без изменения или переквантования весов. Работает на Apple Silicon через MLX.
-
6,4
TianyuCodings/NanoJev
Реплика модели Jev на базе Qwen3-0.6B: выдаёт распределения вероятностей по кандидатам за один forward-проход без декодирования токенов, с пайплайном обучения и демо на играх (лабиринт, Snake).
-
6,3
zhengkid/Dream-RSI
Исследовательский проект о рекурсивном самоулучшении: история прошлых циклов поиска превращается в replay-симулятор, по которому оценивают и улучшают стратегии исследования. Код ещё готовится к публикации, доступны…
-
5,0
ekzhang/openjev-sglang
HTTP-сервер, реализующий API TypeSafe/Jev для структурированной классификации текста на базе Qwen3.6-35B-A3B и SGLang; возвращает вероятности ответов без генерации цепочки рассуждений.