# facebookresearch/swe-sweep > Бенчмарк для оценки LLM-агентов на реальных репозиториях: агент должен сам найти и исправить как можно больше багов, без подсказок об их типе и расположении. Обёртка над Harbor с подсчётом итогового счёта. - Магнитуда: 0,8 из 10 — Ровно - Звёзды: 57 всего · +0 звёзд по замерам 2026-10-07, 00:20–03:55 UTC, к вечеру ≈ 1 - Доверие к звёздам: рост звёзд выглядит естественно - Категория: Языковые модели · Язык: Python · Лицензия: MIT · Создан: 2026-10-01 · Последний коммит: 2026-10-01 - GitHub: https://github.com/facebookresearch/swe-sweep · Сайт: https://swesweep.com · Страница: https://gitnova.dev/r/facebookresearch/swe-sweep ## Чем пригодится - Прогнать агента на задаче из tasks/ и получить оценку исправленных багов - Сравнить патчи разных моделей через sweep info с флагом --per-task - Проверить окружение и зависимости командой sweep infra doctor ## Почему он здесь - По замерам счётчика за 2026-10-07 (UTC), 00:20–03:55: 57 → 57 звёзд (+0). Это прирост за указанный интервал. - Репозиторию 6 дней, а у него уже 57 звёзд. Истории меньше двух недель, так что обычного темпа, с которым можно сравнить всплеск, у него ещё нет. - Hacker News: «Show HN: Benchmark: AI doesn't find bugs unless you tell it what's wrong» — 5 очков, 5 дней назад. - Среди свежих форков — заметные разработчики: @mbrukman (394 подп.). ## Доверие к звёздам Рост звёзд выглядит естественно. Метки доверия к звёздам — эвристики по поведению репозитория, а не проверка каждого, кто поставил звезду. ## Цифры - Форков: 5 - Issues и pull requests: 2 - Наблюдателей: 0 - В среднем за неделю: 8 в день - Обычный темп: мало истории (меньше двух недель) - Звёзд за последний час (по замерам): 0 ## Звёзды по дням за 11 дней (от старых к новым, сегодня — неполный день) 2026-09-27 … 2026-10-07: 0, 0, 0, 1, 22, 21, 7, 1, 4, 1, 0 ## Hacker News - Show HN: Benchmark: AI doesn't find bugs unless you tell it what's wrong — 5 очков, 2 комментариев: https://news.ycombinator.com/item?id=49923102 ## Ещё в этой категории 1. **Niko1221/Strata** — 6,4 · На пике · Языковые модели · C++ · +221 звезда по замерам 2026-10-07, 00:19–03:47 UTC, к вечеру ≈ 1 463 Локальный движок инференса на C++, запускающий 125B MoE-модель Qwen3.8-Flash-Next на обычном ПК с одной NVIDIA GPU (12–24 ГБ) и 64 ГБ RAM, с OpenAI/Anthropic-совместимым API на localhost. Полная карточка: https://gitnova.dev/r/Niko1221/Strata.md 2. **deepseek-ai/DeepGEMM** — 6,2 · Взлёт · Языковые модели · Cuda · +59 звёзд по замерам 2026-10-07, 00:20–03:47 UTC, к вечеру ≈ 275 Библиотека CUDA-ядер для тензорных ядер GPU: GEMM (FP8, FP4, BF16), fused MoE, MQA-скоринг для indexer. Ядра компилируются в рантайме через DeepJIT, установка без сборки CUDA. Полная карточка: https://gitnova.dev/r/deepseek-ai/DeepGEMM.md 3. **BudEcosystem/Bud-Decision-Studio** — 4,5 · Ранний сигнал · Языковые модели · HTML · +0 звёзд по замерам 2026-10-07, 00:29–03:48 UTC, к вечеру ≈ 65 Кроссплатформенное десктопное приложение и локальный сервер для запуска decision-моделей: на вход ситуация и типизированные вопросы, на выходе калиброванные вероятности ответов за миллисекунды. Полная карточка: https://gitnova.dev/r/BudEcosystem/Bud-Decision-Studio.md 4. **StayLameBro/backburner** — 4,4 · Ранний сигнал · Языковые модели · Python · +12 звёзд по замерам 2026-10-07, 00:20–03:48 UTC, к вечеру ≈ 85 Форк llama.cpp, который подключает iPhone по USB-C к Mac и распределяет работу: Mac считает слои 1-40, iPhone — 41-64 на своём GPU, что ускоряет prefill и позволяет держать контекст до 196k-229k токенов. Нужен тем, кто запускает Qwen3-27B… Полная карточка: https://gitnova.dev/r/StayLameBro/backburner.md 5. **Hiteater-wzm/eeo** — 4,4 · Ранний сигнал · Языковые модели · JavaScript · +2 звезды по замерам 2026-10-07, 00:20–03:48 UTC, к вечеру ≈ 33 Открытое сообщество и набор инструментов для «Everything Engine Optimization»: бренды публикуют машиночитаемые карточки о себе, а сервис измеряет, насколько бренд виден в ответах AI-движков. Полная карточка: https://gitnova.dev/r/Hiteater-wzm/eeo.md --- Магнитуда (0–10) — насколько быстро и необычно сейчас растёт интерес к репозиторию. Это не оценка качества. Дни — по UTC. «Уже сегодня» — факт, «к вечеру ≈» — прогноз. Описания и сценарии пишет модель (DeepSeek V4.1 Flash) по README, в деталях возможны ошибки: конкретные утверждения (замеры, скорость, железо) проверяйте в самом репозитории. Данные на 2026-10-07 03:58 UTC, обновление каждые 30 минут.