CoolFace
Datasetpublic

simpra/xh-tts-vixsd

isiXhosa TTS clips (ViXSD, segmented) 3,861 clips, 22,050 Hz mono, 8 speakers, cut from long-form recordings by CTC forced alignment. Derived from ViXSD (Vuk'uzenzele isiXhosa Speech Dataset) by Lelapa AI / Way With Words, under the Esethu License — see https://huggingface.co/datasets/lelapa/Vukuzenzele_isiXhosa_Speech_Dataset_ViXSD Pipeline vixsd_extract.py — parquet to mono 22,050 Hz. Source is heterogeneous: rates 16k/22.05k/44.1k/48k/96k, depths 16/24/32, PCM… See the full description on the dataset page: https://huggingface.co/datasets/simpra/xh-tts-vixsd.

sourceHugging Faceotherupdated 14d agoView on Hugging Face
0likes333downloads
13 commits on main
249ce2614d ago

3861 clips, 22050 Hz mono (part 10)

simpra
8d2625d14d ago

3861 clips, 22050 Hz mono (part 9)

simpra
ea215d914d ago

3861 clips, 22050 Hz mono (part 8)

simpra
9480a2914d ago

3861 clips, 22050 Hz mono (part 7)

simpra
602b70f14d ago

3861 clips, 22050 Hz mono (part 6)

simpra
4c61a8514d ago

3861 clips, 22050 Hz mono (part 5)

simpra
020812b14d ago

3861 clips, 22050 Hz mono (part 4)

simpra
7cafa0114d ago

3861 clips, 22050 Hz mono (part 3)

simpra
ee9d03e14d ago

3861 clips, 22050 Hz mono (part 2)

simpra
39f2edf14d ago

3861 clips, 22050 Hz mono

simpra
43a30c514d ago

3861 clips

simpra
d0a8fbd14d ago

dataset card

simpra
d888ff214d ago

initial commit

simpra