Qwen3.8-Flash-Next-oQ4e-mtp
68
2 commits
2 linked in READMEs
updated Aug 27, 2026
This model was quantized using oQ (oMLX v0.6.3rc3) mixed-precision quantization.
Jundot/Qwen3.8-27B-oQ4e-fp16-mtp
Qwen3.8-27B-oQ4e-fp16-mtp
11
wtdcode/Qwen3.8-Flash-Next-AWQ-W4A16
Qwen3.8-Flash-Next-AWQ-W4A16
33
Mia-AiLab/Qwen3.8-Flash-Next-NVFP4
Qwen3.8-Flash-Next-NVFP4 (mirror)
14
AutomatosX/AX-Qwen3-Embedding-8B-MLX-AXQ-4bit
AX-Qwen3-Embedding-8B-MLX-AXQ-4bit
0
AutomatosX/AX-Qwen3.8-27B-MLX-AXQ-4bit-MTP
AX-Qwen3.8-27B-MLX-AXQ-4bit-MTP
4
AutomatosX/AX-Qwen3-Embedding-4B-MLX-AXQ-8bit
AX-Qwen3-Embedding-4B-MLX-AXQ-8bit
AutomatosX/AX-Qwen3.8-27B-MLX-AXQ-MXFP4-MTP
AX-Qwen3.8-27B-MLX-AXQ-MXFP4-MTP — 4.84 BPW measured main
AutomatosX/AX-Qwen3-Embedding-0.6B-MLX-AXQ-4bit
AX-Qwen3-Embedding-0.6B-MLX-AXQ-4bit
jundot/omlx
LLM inference server with continuous batching & SSD caching for Apple Silicon — managed from the…
22,569
yavarb/moefit
Run Qwen3.8-Flash-Next on Apple Silicon Macs that cannot hold the full MoE in RAM — expert paging,…
1