openxla/xla
A machine learning compiler for GPUs, CPUs, and ML accelerators
О проекте
XLA (Accelerated Linear Algebra) — открытый ML-компилятор для GPU, CPU и ML-ускорителей. Принимает модели из PyTorch, TensorFlow и JAX и оптимизирует их под высокопроизводительное выполнение на разном железе.
Чем пригодится
- Скомпилировать модель JAX или TensorFlow для ускоренного выполнения на GPU
- Добавить поддержку нового аппаратного бэкенда в XLA для ML-ускорителя
- Отладить интеграцию ML-фреймворка с XLA при разработке компилятора
Пересказ README моделью DeepSeek V4.1 Flash. Может ошибаться в деталях.
Почему он в тренде
- Сегодня уже 0 звёзд, к концу дня ожидается около 1.
- GitHub Trending C++ за день: #5, +5 звёзд.
Звёзды по дням
Столбики — звёзды за день, линия — обычный темп. Красным — дни всплесков.
Цифры
- Всего звёзд
- 4 554
- Сегодня
- 0 · к вечеру ≈ 1
- Форков
- 949
- Issues и pull requests
- 49 317
- Наблюдателей
- 49
- Язык
- C++
- Лицензия
- Apache-2.0
- Создан
- 9 августа 2022
- Последний коммит
- 24 сентября 2026
Доверие к звёздам
Рост выглядит естественно: форков и обсуждений столько, сколько бывает у живых проектов, а звёзды приходят неровно, как от людей.
Это эвристики, а не приговор: судим по поведению репозитория, а не по списку звездивших.
Где замечен
- 24 сентября 2026GitHub Trending C++ за день: #5, +5 звёзд
Похожие по описанию
-
1,6
microsoft/onnxruntime
Кроссплатформенный ускоритель инференса и обучения ML-моделей. Запускает модели из PyTorch, TensorFlow, scikit-learn и других через формат ONNX с оптимизацией графа и аппаратным ускорением.
-
1,6
NVIDIA/TensorRT-LLM
Библиотека NVIDIA для оптимизации инференса больших языковых моделей и визуальных генеративных моделей на GPU: Python API, специализированные ядра и эффективный рантайм на C++/Python.
-
1,8
NVIDIA/cutlass
CUTLASS — набор CUDA C++ шаблонов и Python DSL (CuTe DSL) для реализации высокопроизводительных операций линейной алгебры, в первую очередь GEMM, на GPU NVIDIA. Проект нужен исследователям и инженерам по…
-
1,6
openvinotoolkit/openvino
OpenVINO — открытый тулкит для оптимизации и развёртывания инференса моделей глубокого обучения на CPU, GPU и NPU Intel. Поддерживает модели из PyTorch, TensorFlow, ONNX, Keras, PaddlePaddle, JAX/Flax и Hugging Face с…
-
1,1
deepseek-ai/DeepJIT
Header-only C++20 JIT-рантайм для компиляции и запуска ядер на GPU NVIDIA CUDA и NPU Huawei Ascend с общим интерфейсом, кэшированием бинарников и интеграцией с PyTorch.
-
3,9
General-Instinct/InstinctFlash
Высокопроизводительный runtime для запуска робототехнических моделей (VLA, WAM, policies) с ускорением через FP8 и оптимизированные ядра на Jetson Thor, RTX 4090/5090.