CoolFace
Datasetpublic

simpra/xh-tts-slr32-norm

isiXhosa TTS — SLR32 prepared for VITS Multi-speaker isiXhosa speech, resampled and text-normalised for VITS training. Each audio file is paired with its transcript in metadata.csv. Attribution (required by the licence) Derived from OpenSLR SLR32, "High quality TTS data for four South African languages (af, st, tn, xh)", created by North West University and Google (2017), released under CC BY-SA 4.0. Source: https://openslr.org/32/ This derivative is likewise CC… See the full description on the dataset page: https://huggingface.co/datasets/simpra/xh-tts-slr32-norm.

sourceHugging Facecc-by-sa-4.0updated 14d agoView on Hugging Face
0likes129downloads
10 commits on main
5d8b5b014d ago

loudness-normalised to -23.0 dBFS (part 7)

simpra
a39103914d ago

loudness-normalised to -23.0 dBFS (part 6)

simpra
16f676214d ago

loudness-normalised to -23.0 dBFS (part 5)

simpra
39d2f7014d ago

loudness-normalised to -23.0 dBFS (part 4)

simpra
3c91f4714d ago

loudness-normalised to -23.0 dBFS (part 3)

simpra
1189f4814d ago

loudness-normalised to -23.0 dBFS (part 2)

simpra
d970a7f14d ago

loudness-normalised to -23.0 dBFS

simpra
155753714d ago

2161 clips, RMS -23.0 dBFS

simpra
b3c032614d ago

carry over dataset card

simpra
6c34deb14d ago

initial commit

simpra