NMikka/Common-Voice-Geo-Cleaned
Common Voice Georgian — Cleaned for TTS/STT A high-quality subset of Mozilla Common Voice Georgian cleaned and filtered specifically for text-to-speech fine-tuning. Dataset Summary Total samples 21,421 Total duration 35.0 hours Speakers 12 Sample rate 24 kHz mono WAV Language Georgian (kat) Source Mozilla Common Voice 19.0 License CC-0 (public domain) Splits Split Samples Description train 20,300 Training… See the full description on the dataset page: https://huggingface.co/datasets/NMikka/Common-Voice-Geo-Cleaned.
9164
../
eval-00000-of-00001.parquetdownload
test-00000-of-00001.parquetdownload
train-00000-of-00013.parquetdownload
train-00001-of-00013.parquetdownload
train-00002-of-00013.parquetdownload
train-00003-of-00013.parquetdownload
train-00004-of-00013.parquetdownload
train-00005-of-00013.parquetdownload
train-00006-of-00013.parquetdownload
train-00007-of-00013.parquetdownload
train-00008-of-00013.parquetdownload
train-00009-of-00013.parquetdownload
train-00010-of-00013.parquetdownload
train-00011-of-00013.parquetdownload
train-00012-of-00013.parquetdownload
