CoolFace
Datasetpublic

chosenek/czech-speech-combined

Czech Speech Combined Dataset Quality-filtered Czech speech dataset for TTS/ASR training. 146,153 clips across ~1,700 speakers from 5 sources. Sources Source Clips Hours Speakers Origin audiobooks 24,535 ~33h 13 Czech audiobook narrations audiobooks_new 28,131 ~39h 8+ Czech audiobook narrations yodas_czech 28,208 ~37h ~2,300 YODAS YouTube speech (quality-filtered) voxpopuli_czech 12,679 ~33h 45 VoxPopuli parliament speech commonvoice_czech 52… See the full description on the dataset page: https://huggingface.co/datasets/chosenek/czech-speech-combined.

sourceHugging Facecc-by-4.0updated 4mo agoView on Hugging Face
2likes156downloads
4 commits on main
8b19d454mo ago

Add files using upload-large-folder tool

chosenek
944755d4mo ago

Add files using upload-large-folder tool

chosenek
ab52d104mo ago

Upload README.md with huggingface_hub

chosenek
d2c3f0d4mo ago

initial commit

chosenek