Automatic Speech Recognition (ASR)

32 repos

Python-based libraries, models, and frameworks for converting spoken audio into text using deep learning approaches. The cluster covers end-to-end ASR systems, model implementations (particularly with PyTorch and ONNX), training pipelines, and deployment-ready solutions. Includes both general-purpose transcription tools and specialized variants like multilingual and robust ASR models designed for real-world audio conditions.

Python · 14
C++ · 7
C · 5
C# · 2
Dockerfile · 1
Rust · 1
speech-recognition ·250,102
speech-to-text ·242,881
whisper ·140,858
transformer ·139,571
openai ·133,107
inference ·132,378
asr ·75,754
pytorch ·68,441
transcription ·62,578
multilingual-asr ·61,961