# SemiAnalysisAI/InferenceX > Открытая платформа для непрерывного бенчмаркинга инференса LLM: измеряет производительность SGLang, vLLM, TensorRT-LLM на GPU NVIDIA, AMD и TPU и публикует живые результаты на дашборде. - Магнитуда: 1,4 из 10 — Ровно - Звёзды: 1 784 всего · +4 звезды сегодня, к вечеру ≈ 8 - Доверие к звёздам: рост звёзд выглядит естественно - Категория: Языковые модели · Язык: Python · Лицензия: Apache-2.0 · Создан: 2025-07-12 · Последний коммит: 2026-09-29 - GitHub: https://github.com/SemiAnalysisAI/InferenceX · Сайт: https://inferencex.com/ · Страница: https://gitnova.dev/r/SemiAnalysisAI/InferenceX ## Чем пригодится - Запустить бенчмарки end-to-end инференса для сравнения SGLang и vLLM на своих GPU - Проверить производительность новых релизов CUDA или ROCm на поддерживаемых SKU - Оценить энергопотребление системы через power_model для планирования дата-центра ## Почему он здесь - Сегодня уже 4 звезды, к концу дня ожидается около 8. - GitHub Trending Python за день: #6, +8 звёзд. ## Доверие к звёздам Рост звёзд выглядит естественно. Метки доверия к звёздам — эвристики по поведению репозитория, а не проверка каждого, кто поставил звезду. ## Цифры - Форков: 309 - Issues и pull requests: 3 551 - Наблюдателей: 14 - В среднем за неделю: 6 в день - Обычный темп: 8 в день - Звёзд за последний час (по замерам): 1 - Последний релиз: tilert-v0.1.5.post2-inferencex.1 (2026-08-19) ## Звёзды по дням за 30 дней (от старых к новым, сегодня — неполный день) 2026-08-31 … 2026-09-29: 11, 12, 3, 5, 8, 2, 2, 3, 6, 13, 13, 4, 1, 0, 18, 17, 9, 4, 12, 6, 5, 3, 6, 6, 5, 0, 5, 5, 10, 4 ## Где замечен сейчас - GitHub Trending Python за день: #6, +8 звёзд ## Ещё в этой категории 1. **firelex/jeff** — 8,2 · Ранний сигнал · Языковые модели · Python · +255 звёзд сегодня, к вечеру ≈ 486 Небольшие дообученные модели Qwen3.5 и Gemma 4 для zero-shot классификации: по описанию ситуации и списку вариантов возвращают калиброванную вероятность для каждого варианта за один forward pass. Полная карточка: https://gitnova.dev/r/firelex/jeff.md 2. **VectifyAI/PageIndex** — 7,4 · Взлёт · Языковые модели · Python · +285 звёзд сегодня, к вечеру ≈ 538 Движок RAG без векторной базы: строит иерархический древовидный индекс документа и ищет по нему рассуждениями LLM, как человек по оглавлению. Для длинных профессиональных PDF — финансовых, юридических, технических. Полная карточка: https://gitnova.dev/r/VectifyAI/PageIndex.md 3. **Niko1221/Strata** — 7,2 · Ранний сигнал · Языковые модели · C++ · +183 звезды сегодня, к вечеру ≈ 387 Локальный движок инференса на C++, запускающий 125B MoE-модель Qwen3.8-Flash-Next на обычном ПК с одной NVIDIA GPU (12–24 ГБ) и 64 ГБ RAM, с OpenAI/Anthropic-совместимым API на localhost. Полная карточка: https://gitnova.dev/r/Niko1221/Strata.md 4. **PostHog/jeeves** — 6,6 · Ранний сигнал · Языковые модели · Python · +83 звезды сегодня, к вечеру ≈ 119 Jeeves — это reasoning-модель на базе Qwen3.5-9B (LoRA + pointer head), обученная через SFT и CISPO, которая перед ответом рассуждает и выдаёт калиброванные вероятности для yes/no, multiple-choice и rating вопросов через Jev-совместимый… Полная карточка: https://gitnova.dev/r/PostHog/jeeves.md 5. **ollaya-dev/ollaya** — 5,6 · Ранний сигнал · Языковые модели · Rust · +40 звёзд сегодня, к вечеру ≈ 90 Локальный рантайм для decision-моделей: скачивает и обслуживает модели классификации и маршрутизации через API, совместимый с TypeSafe. Аналог Ollama, но для моделей, возвращающих вероятности, а не текст. Полная карточка: https://gitnova.dev/r/ollaya-dev/ollaya.md --- Магнитуда (0–10) — насколько быстро и необычно сейчас растёт интерес к репозиторию. Это не оценка качества. Дни — по UTC. «Уже сегодня» — факт, «к вечеру ≈» — прогноз. Описания и сценарии пишет модель (DeepSeek V4.1 Flash) по README, в деталях возможны ошибки: конкретные утверждения (замеры, скорость, железо) проверяйте в самом репозитории. Данные на 2026-09-29 13:28 UTC, обновление каждые 30 минут.