4 repos
WangHelin1997/CapSpeech
CapSpeech: Enabling Downstream Applications in Style-Captioned Text-to-Speech
372
21 commits
WangHelin1997/SoloAudio
SoloAudio: Target Sound Extraction with Language-oriented Audio Diffusion Transformer.
124
62 commits
Audio-Foundation-Models/ConversationTTS
No description
103
8 commits
cdjkim/audiocaps
🔊 Repository for our NAACL-HLT 2019 paper: AudioCaps
216
7 commits