lostmsu/TurboGPT
Train a tiny GPT in under a minute (CUDA only)
О проекте
Обучение крошечного byte-level GPT на CUDA C++ с нуля менее чем за минуту; подходит для экспериментов с обучением языковых моделей на локальной GPU.
Чем пригодится
- Обучить мини-GPT на своём текстовом файле и получить чекпоинт для дальнейшего дообучения
- Возобновить прерванное обучение из сохранённого чекпоинта через --load
- Проверить качество модели по метрике BPB на датасете hn1g
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня 19 звёзд.
- Репозиторию 6 дней, а у него уже 19 звёзд. Истории меньше двух недель, так что обычного темпа, с которым можно сравнить всплеск, у него ещё нет.
- Hacker News: «Show HN: TurboGPT: train 22KiB transformer in 13s» — 36 очков, 3 ч назад.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 19
- Сегодня
- 19
- Форков
- 0
- Issues и pull requests
- 0
- Наблюдателей
- 0
- Язык
- C++
- Лицензия
- MIT
- Последний релиз
- v0.0.1 · 29 сентября 2026
- Создан
- 23 сентября 2026
- Последний коммит
- 29 сентября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Обсуждения на Hacker News
- Show HN: TurboGPT: train 22KiB transformer in 13s36 очков, 29 сентября 2026
Где замечен
- 29 сентября 2026Замечен на Hacker News
Похожие по описанию
-
1,5
volotat/mini-AGI
Байтовая языковая модель непрерывного обучения, которая сама собирает архитектуру, тренируется с нуля на одной GPU с 8 ГБ VRAM и продолжает учиться на всём, что читает. Эксперимент, показывающий, что continual learning…
-
3,5
microsoft/SkillOpt
Текстовый оптимизатор, который обучает переиспользуемые навыки на естественном языке для замороженных LLM-агентов: правки на основе траекторий, обновления с проверкой на валидации и артефакт best_skill.md. Веса модели…
-
2,5
jingyaogong/minimind
Учебный проект с открытым кодом для обучения сверхмалой языковой модели MiniMind (64M параметров) с нуля на PyTorch, включая полный цикл: pretrain, SFT, LoRA, RLHF, RLAIF и Tool Use.
-
1,5
MrNeRF/LichtFeld-Studio
Нативное приложение для обучения, просмотра, редактирования и экспорта сцен 3D Gaussian Splatting, с Python-плагинами и автоматизацией через MCP. Работает на NVIDIA GPU с CUDA 12.8+.