Сейсмограф

Что набирает звёзды на GitHub прямо сейчас

SeerRay-Lab/Xiaomi-OCR-0

Языковые моделиPython
Открыть на GitHub
Другие действия
Мой радар Открыть на Сейсмографе

О проекте

Унифицированная vision-language модель на 0.8B параметров для разбора документов и OCR-задач: выдаёт структурированный Markdown, извлекает поля в JSON и отвечает на вопросы по изображениям.

Чем пригодится
  • Разобрать страницы PDF или сканы в структурированный Markdown с таблицами и формулами
  • Извлечь нужные поля из документов в JSON через KIE
  • Задать вопросы по содержимому изображения документа через VQA

Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.

0,9 Ровно Магнитуда из 10 — скорость роста интереса, а не оценка качества.

Рост звёзд выглядит естественно. Данные на 3 октября 2026, 01:56 UTC.

Оценка роста звёзд не подтверждает безопасность запуска.

Звёзды по дням

0204027 сентября 20263 октября 2026

Столбики — звёзды за день; линия — скользящее среднее доступной истории. При короткой истории оно ещё не задаёт надёжный обычный темп. Красным — дни всплесков.

Почему он в тренде

  • Сегодня уже 0 звёзд, к концу дня ожидается около 4.
  • Репозиторию 5 дней, а у него уже 56 звёзд. Истории меньше двух недель, так что обычного темпа, с которым можно сравнить всплеск, у него ещё нет.
  • Топ новых репозиториев за неделю: #191.

Посмотри похожие проекты

  1. PaddlePaddle/PaddleOCR

    OCR-тулкит и движок разбора документов: превращает PDF и изображения в структурированные данные (JSON/Markdown) для LLM, поддерживает 100+ языков и распознавание таблиц, формул и печатей.

    Сходство описаний и сценариев использования
  2. run-llama/liteparse

    Локальный парсер документов на Rust: извлекает текст с координатами (bounding boxes) из PDF, DOCX, XLSX, PPTX и изображений, поддерживает OCR через Tesseract или HTTP-серверы. Работает без облака и LLM, есть биндинги…

    Сходство описаний и сценариев использования
  3. beatrizalmeidaf/papero-pdf-text-extractor

    Открытый API и Python-библиотека для извлечения структуры PDF: порядок чтения, таблицы, формулы, рисунки и координаты блоков. Работает на CPU без ML-моделей, файлы не сохраняются.

    Сходство описаний и сценариев использования

Три GitHub-находки каждый день

Что делают, почему набирают интерес и что проверить перед использованием.

Поделиться в X Telegram

Цифры

Всего звёзд
56
Сегодня
0 · к вечеру ≈ 4
Форков
0
Issues и pull requests
0
Наблюдателей
1
Язык
Python
Лицензия
Apache-2.0
Создан
28 сентября 2026
Последний коммит
30 сентября 2026

Доверие к звёздам

Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.

Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.

Где замечен
Бейдж для README

Вставьте в README — бейдж сам показывает свежую магнитуду и ведёт на эту страницу.

Сейсмограф: 0,9
[![Сейсмограф](https://gitnova.dev/badge/SeerRay-Lab/Xiaomi-OCR-0.svg)](https://gitnova.dev/r/SeerRay-Lab/Xiaomi-OCR-0)