Zeyue7/Audio-Omni

Space

1

stars

13

commits

1

linked in READMEs

Apr 14, 2026

updated

audio-editing
audio-generation
diffusion
gradio
multimodal
music
speech
text-to-audio
text-to-speech

README

🎛️ Audio-Omni: Unified Audio Understanding, Generation, and Editing

SIGGRAPH 2026

Audio-Omni is the first end-to-end framework that unifies understanding, generation, and editing across general sound, music, and speech domains.

Capabilities

  • Understanding: Audio/video captioning, question answering
  • Generation: Text-to-Audio, Text-to-Music, Video-to-Audio, Video-to-Music, Text-to-Speech, Voice Conversion
  • Editing: Add, Remove, Extract, Style Transfer

Contributors

Zeyue7

13 commits

Zeyue7/Audio-Omni

Space

1

stars

13

commits

1

linked in READMEs

Apr 14, 2026

updated

audio-editing
audio-generation
diffusion
gradio
multimodal
music
speech
text-to-audio
text-to-speech

README

🎛️ Audio-Omni: Unified Audio Understanding, Generation, and Editing

SIGGRAPH 2026

Audio-Omni is the first end-to-end framework that unifies understanding, generation, and editing across general sound, music, and speech domains.

Capabilities

  • Understanding: Audio/video captioning, question answering
  • Generation: Text-to-Audio, Text-to-Music, Video-to-Audio, Video-to-Music, Text-to-Speech, Voice Conversion
  • Editing: Add, Remove, Extract, Style Transfer

Contributors

Zeyue7

13 commits