Сейсмограф

Что набирает звёзды на GitHub прямо сейчас

huggingface/tokenizers

💥 Fast State-of-the-Art Tokenizers optimized for Research and Production

Языковые моделиRust#nlp#natural-language-processing#natural-language-understanding#language-model#transformers
2,5 Ровно Магнитуда из 10 — скорость роста интереса, а не оценка качества. Рост звёзд выглядит естественно. Данные на 22 сентября 2026, 12:33 UTC.
Открыть на Сейсмографе Открыть на GitHub

О проекте

Библиотека токенизации от Hugging Face на Rust с биндингами для Python и Node.js: быстрая реализация BPE, Unigram, WordPiece и WordLevel для обучения и инференса моделей NLP.

Чем пригодится

Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.

Почему он в тренде

Звёзды по дням

0102025 июня 202622 сентября 2026

Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.

Цифры

Всего звёзд
11 071
Сегодня
4 · к вечеру ≈ 10
Форков
1 206
Issues и pull requests
2 412
Наблюдателей
122
Язык
Rust
Лицензия
Apache-2.0
Последний релиз
v1.0.0-rc.2 · 21 сентября 2026
Создан
1 ноября 2019
Последний коммит
21 сентября 2026

Доверие к звёздам

Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.

Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.

Где замечен

Поделиться

Бейдж для README

Вставьте в README — бейдж сам показывает свежую магнитуду и ведёт на эту страницу.

Сейсмограф: 2,5
[![Сейсмограф](https://gitnova.dev/badge/huggingface/tokenizers.svg)](https://gitnova.dev/r/huggingface/tokenizers)

Похожие по описанию

  1. 1,2
    deepseek-ai/deepseek-recipe

    Набор Rust-библиотек и Python-биндингов для преобразования API-запросов разных форматов (Messages, Chat Completions, Responses) в формат Conversation, кодирования их в промпты для моделей DeepSeek V4/V4.1 и обратного…

    ОстываетЯзыковые моделиRust+0 звёзд сегодня, к вечеру ≈ 1

  2. 1,2
    marin-community/marin

    Открытая платформа и сообщество для исследований и разработки foundation-моделей: подготовка данных, токенизация, pretraining, posttraining и оценка LLM. Подходит исследователям и инженерам, обучающим языковые и…

    ОстываетЯзыковые моделиPython+4 звезды сегодня, к вечеру ≈ 8

  3. 2,6
    huggingface/transformers

    Фреймворк для определения и запуска предобученных ML-моделей (текст, зрение, аудио, мультимодальные) для инференса и обучения, совместимый с большинством тренировочных и инференс-движков.

    ОстываетЯзыковые моделиPython+20 звёзд сегодня, к вечеру ≈ 44

  4. 3,3
    ggml-org/llama.cpp

    Реализация инференса LLM и VLM на C/C++ без зависимостей, работающая на CPU и GPU разного железа. Позволяет запускать модели локально с минимальной настройкой и квантованием.

    РовноЯзыковые моделиC+++38 звёзд сегодня, к вечеру ≈ 89