FareedKhan-dev/train-llm-from-scratch
A straightforward method for training your LLM, from downloading data to generating text.
О проекте
Учебный проект: реализация Transformer с нуля на PyTorch и полный пайплайн обучения LLM — от сырого текста до SFT, reward model, PPO/DPO/GRPO и чата, без transformers, trl и peft.
Чем пригодится
- Обучить небольшой LLM на одном GPU по шагам из README
- Разобрать устройство attention и Transformer по исходникам
- Проверить этапы post-training: SFT, reward model, DPO, PPO, GRPO
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня уже 39 звёзд, к концу дня ожидается около 116. Обычный темп — 12 в день, сейчас в 9,3 раза больше.
- За последние двое суток темп в 18 раз выше, чем в предыдущие полторы недели.
- Всплеск держится 3 дня подряд — это не случайный выброс.
- GitHub Trending Python за день: #5, +196 звёзд.
- Около 40 форков в сутки — код забирают себе.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 10 004
- Звёзд за сутки
- 116
- Форков
- 1 389
- Issues и pull requests
- 40
- Наблюдателей
- 80
- Язык
- Python
- Лицензия
- MIT
- Создан
- 12 января 2025
- Последний коммит
- 17 августа 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Где замечен
- 20 сентября 2026GitHub Trending Python за день: #5, +196 звёзд
Похожие проекты
-
7,4
TianyuCodings/NanoJev
Реплика модели Jev на базе Qwen3-0.6B: выдаёт распределения вероятностей по кандидатам за один forward-проход без декодирования токенов, с пайплайном обучения и демо на играх (лабиринт, Snake).
-
7,2
mizorewww/laya-mlx
Нативный MLX-рантайм для типизированных решающих моделей Laya: возвращает вероятности выбора, оценки или истинности без генерации текста, работает локально на Apple Silicon.
-
7,0
bespokelabsai/nimble
Nimble — модель и рецепт обучения для быстрых типизированных решений по тексту: по схеме из enum- и boolean-полей она выбирает ответ и возвращает вероятности каждого варианта. Нужна для маршрутизации, проверки условий…
-
7,0
docling-project/docling
Docling — библиотека для парсинга документов разных форматов (PDF, DOCX, PPTX, XLSX, HTML, EPUB, аудио и видео) с расширенным пониманием PDF: разметка страниц, таблицы, формулы, OCR. Готовит структурированные данные…
-
6,9
githubnext/localjev
Локальный HTTP-сервис на TypeScript для Bun, реализующий Jev-совместимый API POST /v1/systemone поверх OpenAI-совместимого Chat Completions (DiffusionGemma через oMLX). Нужен как мост для типизированных решений без…
-
6,8
jaredpalmer/kev
kev — LoRA-адаптер с небольшим readout-хедом на базе Qwen2.5-0.5B, который за один forward pass отвечает на множество типизированных вопросов по документу, выдавая калиброванные вероятности вместо текста.