ASLP-lab/WSChuan-ASR

Model

7

stars

20

commits

1

linked in READMEs

Jan 9, 2026

updated

ASR
automatic-speech-recognition
chinese
safetensors
speech

README

📂 Project Tree

WSChuan-ASR
├── paraformer_large_chuan/
│ ├── config.yaml
│ ├── model.pt
│ └── infer.py
│
├── Qwen2.5-omni3B/
| ├──added_tokens.json
| ├──args.json
| ├──char_template.jinja
| ├──config.json
| ├──generation_config.json
| ├──merges.txt
| ├──model-00001-of-00003.safetensors
| ├──model-00002-of-00003.safetensors
| ├──model-00003-of-00003.safetensors
| ├──model.safetensors.index.json
| ├──preprocessor_config.json
| ├──special_tokens_map.json
| ├──spk_dict.pt
| ├──tokenizer_config.json
| ├──tokenizer.json
| ├──video_preprocessor_config.json
| └──vocab.json
│
├── .gitattributes
└── README.md

ASR Leaderboard

ModelModel SizeWSC-Eval-ASR - EasyWSC-Eval-ASR - HardWSC-Eval-ASR - TotalMagicdata - ConversationMagicdata - Daily-UseAvg.
with LLM
Kimi-Audio7B16.6528.6617.6624.675.7718.68
FireRedASR-LLM8.3B12.8025.2714.4017.686.6915.37
Qwen2.5-omni3B16.9426.0118.2020.406.3217.69
Qwen2.5-omni-WSC-Finetune⭐3B14.3624.1415.6118.456.1515.74
Qwen2.5-omni+internal data⭐3B13.1723.3614.8118.505.8815.14
Qwen2.5-omni-WSC-Finetune + internal data⭐3B12.9323.1914.2517.955.8914.84
without LLM
SenseVoice-small234M17.4328.3818.3923.508.7719.29
Whisper244M52.0663.9953.5955.8852.0355.51
FireRedASR-AED1.1B13.2923.6414.6217.846.6915.14
Paraformer220M14.3424.6115.6619.818.1616.52
Paraformer-WSC-Finetune⭐220M12.1522.6013.5116.608.0214.58
Paraformer + internal data⭐220M11.9321.8213.1415.616.7713.85
Paraformer-WSC-Finetune + internal data220M11.5921.5912.8714.596.2813.38

ASR Inference

Paraformer_large_Chuan

export CUDA_VISIBLE_DEVICES=7
root_dir=./test_data
test_sets=("WSC-Eval-ASR" "WSC-Eval-ASR-Hard" "WSC-Eval-ASR-Easy")
model_dir=./model_dir

out_rootdir=./results
mkdir -p $out_rootdir
python infer_paraformer.py \
  --model $model_dir \
  --wav_scp_file $root_dir/$test_data/wav.scp \
  --output_dir $out_rootdir/debug \
  --device "cuda" \
  --output_file $out_dir/hyp.txt

Qwen2.5-Omni-3B_Chuan

python infer_qwen2.5omni.py \
    --wavs_path /path/to/your/wav.scp \
    --out_path /path/to/your/results.txt \
    --gpu 0 \
    --model /path/to/your/model

Contributors

ASLP-lab

20 commits

ASLP-lab/WSChuan-ASR

Model

7

stars

20

commits

1

linked in READMEs

Jan 9, 2026

updated

ASR
automatic-speech-recognition
chinese
safetensors
speech

README

📂 Project Tree

WSChuan-ASR
├── paraformer_large_chuan/
│ ├── config.yaml
│ ├── model.pt
│ └── infer.py
│
├── Qwen2.5-omni3B/
| ├──added_tokens.json
| ├──args.json
| ├──char_template.jinja
| ├──config.json
| ├──generation_config.json
| ├──merges.txt
| ├──model-00001-of-00003.safetensors
| ├──model-00002-of-00003.safetensors
| ├──model-00003-of-00003.safetensors
| ├──model.safetensors.index.json
| ├──preprocessor_config.json
| ├──special_tokens_map.json
| ├──spk_dict.pt
| ├──tokenizer_config.json
| ├──tokenizer.json
| ├──video_preprocessor_config.json
| └──vocab.json
│
├── .gitattributes
└── README.md

ASR Leaderboard

ModelModel SizeWSC-Eval-ASR - EasyWSC-Eval-ASR - HardWSC-Eval-ASR - TotalMagicdata - ConversationMagicdata - Daily-UseAvg.
with LLM
Kimi-Audio7B16.6528.6617.6624.675.7718.68
FireRedASR-LLM8.3B12.8025.2714.4017.686.6915.37
Qwen2.5-omni3B16.9426.0118.2020.406.3217.69
Qwen2.5-omni-WSC-Finetune⭐3B14.3624.1415.6118.456.1515.74
Qwen2.5-omni+internal data⭐3B13.1723.3614.8118.505.8815.14
Qwen2.5-omni-WSC-Finetune + internal data⭐3B12.9323.1914.2517.955.8914.84
without LLM
SenseVoice-small234M17.4328.3818.3923.508.7719.29
Whisper244M52.0663.9953.5955.8852.0355.51
FireRedASR-AED1.1B13.2923.6414.6217.846.6915.14
Paraformer220M14.3424.6115.6619.818.1616.52
Paraformer-WSC-Finetune⭐220M12.1522.6013.5116.608.0214.58
Paraformer + internal data⭐220M11.9321.8213.1415.616.7713.85
Paraformer-WSC-Finetune + internal data220M11.5921.5912.8714.596.2813.38

ASR Inference

Paraformer_large_Chuan

export CUDA_VISIBLE_DEVICES=7
root_dir=./test_data
test_sets=("WSC-Eval-ASR" "WSC-Eval-ASR-Hard" "WSC-Eval-ASR-Easy")
model_dir=./model_dir

out_rootdir=./results
mkdir -p $out_rootdir
python infer_paraformer.py \
  --model $model_dir \
  --wav_scp_file $root_dir/$test_data/wav.scp \
  --output_dir $out_rootdir/debug \
  --device "cuda" \
  --output_file $out_dir/hyp.txt

Qwen2.5-Omni-3B_Chuan

python infer_qwen2.5omni.py \
    --wavs_path /path/to/your/wav.scp \
    --out_path /path/to/your/results.txt \
    --gpu 0 \
    --model /path/to/your/model

Contributors

ASLP-lab

20 commits