Сейсмограф

Что набирает звёзды на GitHub прямо сейчас

datalab-to/chandra

Языковые моделиPython#ai#ocr
Открыть на GitHub
Другие действия
Мой радар Открыть на Сейсмографе

OCR model that handles complex tables, forms, handwriting with full layout.

О проекте

Chandra OCR 2 — OCR-модель, которая превращает изображения и PDF в структурированные HTML, Markdown или JSON с сохранением разметки, таблиц, формул и рукописного текста.

Чем пригодится
  • Распознать сканы PDF в Markdown с сохранением таблиц и разметки
  • Извлечь данные из форм и рукописных документов в JSON
  • Запустить локальный OCR через CLI или Streamlit-приложение

Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.

2,1 Ровно Магнитуда из 10 — скорость роста интереса, а не оценка качества.

Рост звёзд выглядит естественно. Данные на 3 октября 2026, 14:03 UTC.

Оценка роста звёзд не подтверждает безопасность запуска.

Звёзды по дням

0501006 июля 20263 октября 2026

Столбики — звёзды за день; линия — скользящее среднее доступной истории. При короткой истории оно ещё не задаёт надёжный обычный темп. Красным — дни всплесков.

Почему он в тренде

  • Сегодня уже 4 звезды, к концу дня ожидается около 10.
  • За последние двое суток темп в 2,9 раза выше, чем в предыдущие полторы недели.
  • Всплеск держится 2 дня подряд — это не случайный выброс.
  • GitHub Trending Python за день: #5, +20 звёзд.

Посмотри похожие проекты

  1. PaddlePaddle/PaddleOCR

    OCR-тулкит и движок разбора документов: превращает PDF и изображения в структурированные данные (JSON/Markdown) для LLM, поддерживает 100+ языков и распознавание таблиц, формул и печатей.

    Общие темы: ocr
  2. SeerRay-Lab/Xiaomi-OCR-0

    Унифицированная vision-language модель на 0.8B параметров для разбора документов и OCR-задач: выдаёт структурированный Markdown, извлекает поля в JSON и отвечает на вопросы по изображениям.

    Сходство описаний и сценариев использования
  3. beatrizalmeidaf/papero-pdf-text-extractor

    Открытый API и Python-библиотека для извлечения структуры PDF: порядок чтения, таблицы, формулы, рисунки и координаты блоков. Работает на CPU без ML-моделей, файлы не сохраняются.

    Сходство описаний и сценариев использования

Три GitHub-находки в каждом выпуске

Что делают, почему набирают интерес и что проверить перед использованием.

Выпуски в 10:00, 16:00, 22:00 МСК.

Поделиться в X Telegram

Цифры

Всего звёзд
12 391
Сегодня
4 · к вечеру ≈ 10
Форков
1 250
Issues и pull requests
117
Наблюдателей
89
Язык
Python
Лицензия
Apache-2.0
Последний релиз
v0.2.0 · 18 марта 2026
Создан
8 октября 2025
Последний коммит
26 июня 2026

Доверие к звёздам

Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.

Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.

Где замечен
Бейдж для README

Вставьте в README — бейдж сам показывает свежую магнитуду и ведёт на эту страницу.

Сейсмограф: 2,1
[![Сейсмограф](https://gitnova.dev/badge/datalab-to/chandra.svg)](https://gitnova.dev/r/datalab-to/chandra)