Speech Emotion Recognition

7 repos

Speech emotion recognition (SER) systems that detect and classify emotional states—valence, arousal, dominance, and categorical emotions—from audio signals. The cluster centers on WavLM-based models trained on the MSP-Podcast corpus, a primary benchmark dataset for emotion recognition research. Repositories here implement baseline models, fine-tuned variants for multiple languages, and evaluation frameworks for predicting emotional dimensions from spoken language.

Jupyter Notebook · 2
Python · 2
speech-emotion-recognition ·569
wav2vec2 ·567
deep-learning ·564
transformer-models ·564
dominance ·562
msp-podcast ·562
onnx ·562
arousal ·562
valence ·562
audio-classification ·7