14
stars
3
commits
10
repos using this model
1
linked in READMEs
Jun 28, 2026
updated
3 commits
deepseek-ai/dspark_qwen3_4b_block7
50
deepseek-ai/dflash_qwen3_8b_block7
4
deepseek-ai/dspark_qwen3_14b_block7
deepseek-ai/dflash_qwen3_4b_block7
2
deepseek-ai/dflash_qwen3_14b_block7
6
deepseek-ai/eagle3_qwen3_8b_ttt7
TheToad/Qwen3-8B-VerIH
0
deepseek-ai/eagle3_qwen3_4b_ttt7
vllm-project/vllm
A high-throughput and memory-efficient inference and serving engine for LLMs
91,518
dphnAI/sonar
Large-scale LLM inference engine
1,854
MiaAI-Lab/DeepSeek-v4-Flash-DSpark-2x-DGX-Spark
DeepSeek-v4-Flash 0731 recipe for 2x DGX Sparks
1,344
wtdcode/vllm-backport
Dogfooding vLLM backport for older GPUs.
190
MetaX-MACA/vLLM-metax
Community maintained hardware plugin for vLLM on MetaX GPU
169
yhfgyyf/vllm-deepseek-v4-sm89
Run DeepSeek-V4-Flash / Vision-Exp and GLM-5.3-Flash on SM89 (Ada / RTX 4090) and SM120 (RTX PRO…
151
guqiong96/Lvllmds4
A fork of jasl/vllm (codex/ds4-sm120-min-enable) with CPU-GPU hybrid inference support for…
31
charlie12345/vLLM_for_AMD
vLLM optimized for AMD
17
avesed/vllm-ampere-optimized
Optimized VLLM for Ampere
15
guqiong96/Lvllm
deepseek-ai/DeepSpec
DeepSpec: a full-stack codebase for training and evaluating speculative decoding algorithms
7,086