ArtificialAnalysis/aa-agentperf-local
Benchmark local LLM serving by replaying real agent trajectories
О проекте
Инструмент от Artificial Analysis для замера скорости локального сервера LLM: воспроизводит записанные диалоги AI-агента и сообщает пропускную способность и задержки, не оценивая качество ответов.
Чем пригодится
- Замерить пропускную способность и задержки своего llama.cpp, vLLM, SGLang или LM Studio сервера на записанных траекториях агента
- Сравнить скорость разных моделей и железа через managed-run с закреплёнными рецептами и проверкой SHA-256
- Проверить установку и конфигурацию сервера быстрым синтетическим реплеем aa-mini-v1 при контексте 8192
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня уже 0 звёзд, к концу дня ожидается около 7.
- Всплеск держится 3 дня подряд — это не случайный выброс.
- Репозиторию 6 дней, а у него уже 70 звёзд. Истории меньше двух недель, так что обычного темпа, с которым можно сравнить всплеск, у него ещё нет.
- Топ новых репозиториев за неделю: #160.
- Hacker News: «Gemini 4 Argon (High): Intelligence, Performance and Price Analysis» — 111 очков, 1 день назад.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 70
- Сегодня
- 0 · к вечеру ≈ 7
- Форков
- 1
- Issues и pull requests
- 33
- Наблюдателей
- 0
- Язык
- Python
- Лицензия
- Apache-2.0
- Последний релиз
- v0.3.3 · 1 октября 2026
- Создан
- 26 сентября 2026
- Последний коммит
- 1 октября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Обсуждения на Hacker News
- Gemini 4 Argon (High): Intelligence, Performance and Price Analysis111 очков, 30 сентября 2026
- GPT-6.1 Sol replaces GPT-6 Sol after just 7 days, with near-Astra intelligence80 очков, 30 сентября 2026
- Sonnet 5.5 scores just behind Opus 5.5 on Artificial Analysis Intelligence Index11 очков, 28 сентября 2026
- Gemini 4 Argon: Google is back among the top three labs in intelligence achieved6 очков, 1 октября 2026
Где замечен
- 2 октября 2026Топ новых репозиториев за неделю: #160
Ещё в этой категории
-
8,6
Niko1221/Strata
Локальный движок инференса на C++, запускающий 125B MoE-модель Qwen3.8-Flash-Next на обычном ПК с одной NVIDIA GPU (12–24 ГБ) и 64 ГБ RAM, с OpenAI/Anthropic-совместимым API на localhost.
-
6,4
MiaAI-Lab/GLM-5.3-Flash-EXL3-2x-DGX-Sparks-TensorFold
Скрипты для запуска GLM-5.3-Flash на двух NVIDIA DGX Spark через TensorFold с OpenAI-совместимым API, контекстом 1M токенов и поддержкой изображений и видео.
-
5,8
ninjahawk/livenerf
Бенчмарк для отслеживания деградации frontier-моделей после релиза: ежедневно прогоняет фиксированный набор вопросов и статистически измеряет дрейф точности и токенов относительно базовой недели запуска.
-
5,7
VectifyAI/PageIndex
Движок RAG без векторной базы: строит иерархический древовидный индекс документа и ищет по нему рассуждениями LLM, как человек по оглавлению. Для длинных профессиональных PDF — финансовых, юридических, технических.
-
5,3
magnitudedev/magnitude
Открытый inference-движок для потребительского железа: профилирует машину, подбирает лучшие локальные модели, скачивает, настраивает и запускает их, а также подключает вашего агента в один клик.
-
4,8
ashhart/TensorFold
Сервер инференса LLM для Apple Silicon (MLX) и NVIDIA GPU с OpenAI-совместимым API и точным спекулятивным декодированием. Поддерживает семейства Nemotron, Qwen3.8, GLM-5.3 и Gemma 4 с собственными ядрами и…