Evaluating local models
unsloth/gemma-4-26B-A4B-itunsloth/gemma-4-E4B-itJiunsong/supergemma4-26b-uncensored-mlx-4bit-v2leonsarmiento/Qwen3.6-27B-3bit-mlxunsloth/Qwen3.6-35B-A3B-UD-MLX-3bitmlx_lm.server \
--model Jiunsong/supergemma4-26b-uncensored-mlx-4bit-v2 \
--port 8888
unsloth studio -H 0.0.0.0 -p 8888
llama-server \
--model ./Qwen3-Coder-30B-A3B-Instruct-IQ4_XS.gguf \
--n-gpu-layers 99 \
-ot ".ffn_.*_exps.*=CPU" \
--ctx-size 65536 \
--cache-type-k q4_0 \
--cache-type-v q4_0 \
--parallel 1 \
--no-warmup \
--flash-attn on \
--temp 0.7 --min-p 0.01 --top-p 0.80 --top-k 20 \
--repeat-penalty 1.05 \
--jinja \
--host 0.0.0.0 --port 8888
5 commits
Python
100.0%
Evaluating local models
unsloth/gemma-4-26B-A4B-itunsloth/gemma-4-E4B-itJiunsong/supergemma4-26b-uncensored-mlx-4bit-v2leonsarmiento/Qwen3.6-27B-3bit-mlxunsloth/Qwen3.6-35B-A3B-UD-MLX-3bitmlx_lm.server \
--model Jiunsong/supergemma4-26b-uncensored-mlx-4bit-v2 \
--port 8888
unsloth studio -H 0.0.0.0 -p 8888
llama-server \
--model ./Qwen3-Coder-30B-A3B-Instruct-IQ4_XS.gguf \
--n-gpu-layers 99 \
-ot ".ffn_.*_exps.*=CPU" \
--ctx-size 65536 \
--cache-type-k q4_0 \
--cache-type-v q4_0 \
--parallel 1 \
--no-warmup \
--flash-attn on \
--temp 0.7 --min-p 0.01 --top-p 0.80 --top-k 20 \
--repeat-penalty 1.05 \
--jinja \
--host 0.0.0.0 --port 8888
5 commits
Python
100.0%