CoolFace
Modelpublic

vaghawan/xtts-v2-stage-b-female-waxalnlp-3-5epoch-1h-hausa-speaker-female-waxalnlp-3

sourceHugging Faceotherupdated 26d agoView on Hugging Face
0likes16downloads
Model Card

XTTS-v2 Hausa — Stage B — female product voice (waxalnlp-3, 5 epochs, from Stage A)

Fine-tuned Coqui XTTS-v2 for Hausa (ha), trained on vaghawan/hausa-tts-24khz-waxalnlp-3-clean (speaker hausa-speaker-female-waxalnlp-3), init from Stage A checkpoint.

Files

FilePurpose
best_model.pthFine-tuned GPT checkpoint (epoch 5)
config.jsonModel config (includes Hausa language)
vocab.jsonExtended Hausa BPE vocabulary
references/hausa-speaker-female-waxalnlp-3.wavSpeaker reference for hausa-speaker-female-waxalnlp-3
infer.pyInference script
xtts_hausa_patch.pyRequired Hausa runtime patches
env_config.pyConfig loader
config.env.exampleExample settings (copy to config.env)
samples.txtDefault eval sentences
requirements.txtPython dependencies

Quick start

bash
pip install -r requirements.txt
cp config.env.example config.env

python infer.py --model-dir . --speaker-wav references/hausa-speaker-female-waxalnlp-3.wav

# Single line:
python infer.py --model-dir . --text "Ina kwana." --speaker-wav references/hausa-speaker-female-waxalnlp-3.wav --out outputs/out.wav

Training details

  • —Base model: Coqui XTTS-v2
  • —Epochs: 5
  • —Language: Hausa (ha)
  • —Speakers: hausa-speaker-female-waxalnlp-3

License

XTTS-v2 uses the Coqui Public Model License. Check each dataset license before redistribution.