Sparticle62ops/pssa
A custom AI architecture being developed in rust
О проекте
PSSA — исследовательский прототип языковой модели на Rust без ML-фреймворков: рекуррентный state-space слой, банк эпизодической памяти и пластичные веса вместо трансформерной attention. По заявлениям автора, при 1.5M параметров учится быстрее и генерирует текст примерно в 12 раз быстрее трансформера на CPU.
Чем пригодится
- Собрать и запустить прототип через cargo build --release для экспериментов с обучением на своём корпусе
- Сравнить кривые обучения PSSA и трансформера на одном корпусе и токенизаторе
- Проверить градиенты CPU-реализации против CUDA-пути через cargo test --release
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня уже 0 звёзд, к концу дня ожидается около 13. Обычный темп — 0 в день, сейчас в 13 раз больше.
- До этого репозиторий почти не получал звёзд — около 0 в день.
- Всплеск держится 2 дня подряд — это не случайный выброс.
- Репозиторию 42 дня, а у него уже 20 звёзд.
- Hacker News: «PSSA: A non-transformer language model written from scratch in Rust» — 37 очков, 2 ч назад.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 20
- Сегодня
- 0 · к вечеру ≈ 13
- Форков
- 1
- Issues и pull requests
- 2
- Наблюдателей
- 0
- Язык
- Rust
- Лицензия
- GPL-3.0
- Создан
- 19 августа 2026
- Последний коммит
- 30 сентября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Обсуждения на Hacker News
- PSSA: A non-transformer language model written from scratch in Rust37 очков, 30 сентября 2026
Где замечен
- 30 сентября 2026Замечен на Hacker News
Ещё в этой категории
-
7,7
firelex/jeff
Небольшие дообученные модели Qwen3.5 и Gemma 4 для zero-shot классификации: по описанию ситуации и списку вариантов возвращают калиброванную вероятность для каждого варианта за один forward pass.
-
7,7
VectifyAI/PageIndex
Движок RAG без векторной базы: строит иерархический древовидный индекс документа и ищет по нему рассуждениями LLM, как человек по оглавлению. Для длинных профессиональных PDF — финансовых, юридических, технических.
-
7,3
PostHog/jeeves
Jeeves — это reasoning-модель на базе Qwen3.5-9B (LoRA + pointer head), обученная через SFT и CISPO, которая перед ответом рассуждает и выдаёт калиброванные вероятности для yes/no, multiple-choice и rating вопросов…
-
7,3
Niko1221/Strata
Локальный движок инференса на C++, запускающий 125B MoE-модель Qwen3.8-Flash-Next на обычном ПК с одной NVIDIA GPU (12–24 ГБ) и 64 ГБ RAM, с OpenAI/Anthropic-совместимым API на localhost.
-
5,9
ninjahawk/livenerf
Бенчмарк для отслеживания деградации frontier-моделей после релиза: ежедневно прогоняет фиксированный набор вопросов и статистически измеряет дрейф точности и токенов относительно базовой недели запуска.
-
5,7
deepseek-ai/DeepGEMM-Ascend
Порт библиотеки DeepGEMM на платформу Huawei Ascend: набор GEMM-ядер (BF16, FP8, FP4, MQA logits, MegaMoE) с API, совместимым с DeepGEMM, для достижения пиковой производительности NPU.