sarptandoven/SarpAudio

0

stars

1

commits

Python

primary language

Jun 1, 2026

updated

README

pip install -r requirements.txt
pip install -r requirements-reuse.txt
python app.py
python src/inference.py \
  --voice-sample reference.wav \
  --prompt 'A woman speaks warmly, "Hello, how are you today?"' \
  --output output.wav \
  --cfg-scale 2.5 \
  --stg-scale 1.5
from src.inference_server import TTSServer

server = TTSServer(device="cuda")
server.generate_to_file(
    prompt='A woman speaks warmly, "Hello, how are you today?"',
    output="output.wav",
    voice_ref="reference.wav",
)
python generate_5min_demo.py
python src/preprocess.py \
  --dataset-type manifest \
  --index your_data.jsonl \
  --audio-dir /path/to/wavs \
  --output-dir /path/to/preprocessed \
  --checkpoint /path/to/dramabox-audio-components.safetensors \
  --gemma-root /path/to/gemma-3-12b-it-bnb-4bit \
  --max-duration 20.0 \
  --min-duration 2.0
accelerate launch src/train.py --config configs/training_args.example.yaml
python src/validate.py \
  --config configs/val_config.example.yaml \
  --checkpoint /path/to/dramabox-dit-v1.safetensors \
  --full-checkpoint /path/to/dramabox-audio-components.safetensors \
  --gemma-root /path/to/gemma-3-12b-it-bnb-4bit

Contributors

sarptandoven

1 commits

sarptandoven/SarpAudio

0

stars

1

commits

Python

primary language

Jun 1, 2026

updated

README

pip install -r requirements.txt
pip install -r requirements-reuse.txt
python app.py
python src/inference.py \
  --voice-sample reference.wav \
  --prompt 'A woman speaks warmly, "Hello, how are you today?"' \
  --output output.wav \
  --cfg-scale 2.5 \
  --stg-scale 1.5
from src.inference_server import TTSServer

server = TTSServer(device="cuda")
server.generate_to_file(
    prompt='A woman speaks warmly, "Hello, how are you today?"',
    output="output.wav",
    voice_ref="reference.wav",
)
python generate_5min_demo.py
python src/preprocess.py \
  --dataset-type manifest \
  --index your_data.jsonl \
  --audio-dir /path/to/wavs \
  --output-dir /path/to/preprocessed \
  --checkpoint /path/to/dramabox-audio-components.safetensors \
  --gemma-root /path/to/gemma-3-12b-it-bnb-4bit \
  --max-duration 20.0 \
  --min-duration 2.0
accelerate launch src/train.py --config configs/training_args.example.yaml
python src/validate.py \
  --config configs/val_config.example.yaml \
  --checkpoint /path/to/dramabox-dit-v1.safetensors \
  --full-checkpoint /path/to/dramabox-audio-components.safetensors \
  --gemma-root /path/to/gemma-3-12b-it-bnb-4bit

Contributors

sarptandoven

1 commits

Languages

Python

100.0%