Text-to-Audio Generation

11 repos

This cluster focuses on neural models and frameworks for generating audio from text descriptions. The repositories contain implementations of diffusion-based and transformer-based text-to-audio systems, with a strong emphasis on model adaptation, fine-tuning, and inference optimization. Visitors will find research implementations, pre-trained model variants, and endpoints for practical audio generation applications.

Python · 1
audio-generation ·2,907
en ·116
endpoints_compatible ·93
text-to-audio ·91
transformers ·84
diffusers ·36
audio ·29
controlnet ·7
music ·3