FareedKhan-dev/kimi-k3-in-c
A 2.78-trillion-parameter Kimi K3 running inference on a single CPU in 8.24 GB of RAM. Portable C99: no BLAS, no framework, no GPU.
О проекте
Инференс-движок на портируемом C99, запускающий 2,78-триллионную модель Kimi K3 на одном CPU в 8,24 ГБ RAM без BLAS, фреймворков и GPU. Модель стримится с диска, объём памяти влияет только на скорость.
Чем пригодится
- Запустить генерацию текста базовой моделью Kimi K3 на ноутбуке с 8 ГБ RAM
- Сравнить скорость инференса при разных бюджетах памяти через пресеты laptop, desktop, workstation
- Проверить идентичность выходных токенов между инкрементальным режимом и полным пересчётом префикса
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня 60 звёзд.
- За последние двое суток темп в 1,9 раза выше, чем в предыдущие полторы недели.
- Репозиторию 43 дня, а у него уже 7 855 звёзд.
- Топ новых репозиториев за 4 месяца: #48.
- Около 18 форков в сутки — код забирают себе.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 7 855
- Звёзд за сутки
- 61
- Форков
- 1 263
- Issues и pull requests
- 62
- Наблюдателей
- 68
- Язык
- C
- Лицензия
- Apache-2.0
- Последний релиз
- v1.0.0 · 7 августа 2026
- Создан
- 1 августа 2026
- Последний коммит
- 10 сентября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Где замечен
- 13 сентября 2026Топ новых репозиториев за 4 месяца: #48
Похожие проекты
-
6,1
JustVugg/colibri
Инференс-движок на чистом C без зависимостей для запуска больших MoE-моделей (744B–2.8T параметров) на потребительском железе за счёт многоуровневой памяти: VRAM, RAM и диск как единая иерархия для стриминга экспертов.
-
5,7
asgeirtj/system_prompts_leaks
Коллекция извлечённых системных промптов от Anthropic, OpenAI, Google, xAI и других — скрытых инструкций, которые получают чат-боты до первого сообщения пользователя.
-
5,1
kennethwolters/litelm
Облегчённая альтернатива litellm: маршрутизация вызовов LLM между 19 провайдерами и трансляция форматов сообщений в ~2900 строк с двумя зависимостями, без прокси, кэша и трекинга затрат.
-
5,0
MiaAI-Lab/DeepSeek-v4.1-Flash-EXL3-2x-DGX-Sparks
Локальный чекпоинт DeepSeek-V4.1-Flash в квантовании EXL3 2.9 bpw (196 GiB, 39 шардов) для запуска через vLLM с OpenAI-совместимым API на двух NVIDIA GB10 (DGX Spark) с tensor-parallel 2. Включает спекулятивное…
-
4,8
unclecode/crawl4ai
Открытый веб-краулер и скрапер, преобразующий страницы в чистый Markdown, готовый для LLM, RAG и агентов. Работает через Python API, CLI и Docker без API-ключей.
-
4,5
Edge0-AI/Edge0
Открытый фреймворк для стримингового инференса MoE-моделей: эксперты выгружаются с SSD по требованию, а обученный prerouter предсказывает маршрутизацию заранее. Работает на Apple Silicon через MLX, поставляется с двумя…