Community maintained hardware plugin for vLLM on MetaX GPU
169
stars
400
commits
Python
primary language
Sep 4, 2026
updated
| About MetaX | Documentation | #sig-maca |
Latest News π₯
vLLM MetaX is a hardware plugin that enables vLLM to run seamlessly on MetaX GPUs. MetaX provides a cuda-like backend through MACA, delivering a near-native CUDA experience on MetaX hardware.
It is the recommended approach for supporting the MetaX backend within the vLLM community.
The plugin is implemented in accordance with the vLLM plugin RFCs:
These RFCs help ensure proper feature and functionality support when integrating MetaX GPUs with vLLM.
vLLM MetaX currently supports deployment only with Docker images released by the MetaX developer community, which work out of the box.
The Dockerfile for other OS environments is still under testing.
If you want to develop, debug, or test the latest features in vllm-metax, you may need to build it from source. Please follow this source build tutorial.
vllm-metax has three kinds of branches.
For example,
v0.1x.0-devis the development branch for a newly released branch likereleases/v0.1x.0.
v0.1x.0-dev, indicating that the corresponding vllm-metax development branch has been fully tested and released.
For example, vllm-metax's
releases/v0.1x.0corresponds to vLLM'sreleases/v0.1x.0. The same naming rule applies to tags.
Below are the maintained branches:
| Branch | Status | Note |
|---|---|---|
| master | N/A | Tracks vLLM main; functionality is not guaranteed |
| releases/v0.24.0 | Released | Corresponds to vLLM release v0.24.0 |
| releases/v0.23.0 | Released | Corresponds to vLLM release v0.23.0 |
| releases/v0.22.0 | Released | Corresponds to vLLM release v0.22.0 |
| releases/v0.21.0 | Released | Corresponds to vLLM release v0.21.0 |
| releases/v0.20.0 | Released | Corresponds to vLLM release v0.20.0 |
| releases/v0.19.0 | Released | Corresponds to vLLM release v0.19.0 |
| releases/v0.18.0 | Released | Corresponds to vLLM release v0.18.0 |
| releases/v0.17.0 | Released | Corresponds to vLLM release v0.17.0 |
| v0.16.0 | N/A | Skipped |
| releases/v0.15.0 | Released | Corresponds to vLLM release v0.15.0 |
| releases/v0.14.0 | Released | Corresponds to vLLM release v0.14.0 |
| releases/v0.13.0 | Released | Corresponds to vLLM release v0.13.0 |
| releases/v0.12.0 | Released | Corresponds to vLLM release v0.12.0 |
| releases/v0.11.2 | Released | Corresponds to vLLM release v0.11.2 |
| releases/v0.10.2 | Released | Corresponds to vLLM release v0.10.2 |
For more details, please check the Quickstart Guide.
Apache License 2.0, as found in the LICENSE file.
Python
69.2%
Cuda
21.8%
C++
7.5%
Community maintained hardware plugin for vLLM on MetaX GPU
169
stars
400
commits
Python
primary language
Sep 4, 2026
updated
| About MetaX | Documentation | #sig-maca |
Latest News π₯
vLLM MetaX is a hardware plugin that enables vLLM to run seamlessly on MetaX GPUs. MetaX provides a cuda-like backend through MACA, delivering a near-native CUDA experience on MetaX hardware.
It is the recommended approach for supporting the MetaX backend within the vLLM community.
The plugin is implemented in accordance with the vLLM plugin RFCs:
These RFCs help ensure proper feature and functionality support when integrating MetaX GPUs with vLLM.
vLLM MetaX currently supports deployment only with Docker images released by the MetaX developer community, which work out of the box.
The Dockerfile for other OS environments is still under testing.
If you want to develop, debug, or test the latest features in vllm-metax, you may need to build it from source. Please follow this source build tutorial.
vllm-metax has three kinds of branches.
For example,
v0.1x.0-devis the development branch for a newly released branch likereleases/v0.1x.0.
v0.1x.0-dev, indicating that the corresponding vllm-metax development branch has been fully tested and released.
For example, vllm-metax's
releases/v0.1x.0corresponds to vLLM'sreleases/v0.1x.0. The same naming rule applies to tags.
Below are the maintained branches:
| Branch | Status | Note |
|---|---|---|
| master | N/A | Tracks vLLM main; functionality is not guaranteed |
| releases/v0.24.0 | Released | Corresponds to vLLM release v0.24.0 |
| releases/v0.23.0 | Released | Corresponds to vLLM release v0.23.0 |
| releases/v0.22.0 | Released | Corresponds to vLLM release v0.22.0 |
| releases/v0.21.0 | Released | Corresponds to vLLM release v0.21.0 |
| releases/v0.20.0 | Released | Corresponds to vLLM release v0.20.0 |
| releases/v0.19.0 | Released | Corresponds to vLLM release v0.19.0 |
| releases/v0.18.0 | Released | Corresponds to vLLM release v0.18.0 |
| releases/v0.17.0 | Released | Corresponds to vLLM release v0.17.0 |
| v0.16.0 | N/A | Skipped |
| releases/v0.15.0 | Released | Corresponds to vLLM release v0.15.0 |
| releases/v0.14.0 | Released | Corresponds to vLLM release v0.14.0 |
| releases/v0.13.0 | Released | Corresponds to vLLM release v0.13.0 |
| releases/v0.12.0 | Released | Corresponds to vLLM release v0.12.0 |
| releases/v0.11.2 | Released | Corresponds to vLLM release v0.11.2 |
| releases/v0.10.2 | Released | Corresponds to vLLM release v0.10.2 |
For more details, please check the Quickstart Guide.
Apache License 2.0, as found in the LICENSE file.
Python
69.2%
Cuda
21.8%
C++
7.5%