CoolFace
Datasetpublic

salisai/urdu-tts-mini

Dataset Card for Urdu-TTS-Mini A curated Urdu speech dataset for Text-to-Speech (TTS) and Automatic Speech Recognition (ASR) research. Audio segments are extracted from publicly available YouTube speech content, processed through a multi-stage quality pipeline, and annotated with Urdu transcriptions. This is a mini release intended to validate the preprocessing pipeline and establish a quality baseline for future large-scale versions. Dataset Details… See the full description on the dataset page: https://huggingface.co/datasets/salisai/urdu-tts-mini.

sourceHugging Facecc-by-4.0updated 3mo agoView on Hugging Face
1likes23downloads
5 commits on main
328661a3mo ago

Update README.md

salisai
9e055a03mo ago

Update README.md

salisai
69476203mo ago

Updated some content in readme.

salisai
c05387c3mo ago

Upload dataset

salisai
dcd13863mo ago

initial commit

salisai