CoolFace
Datasetpublic

Flamme-VRM/kazakh-speech-dataset

Kazakh Speech Dataset If you find this dataset helpful please press 'like' button Summary The Kazakh Speech Dataset is a large-scale open-source speech corpus for the Kazakh language. This dataset is designed to support the development of Automatic Speech Recognition (ASR) and Text-to-Speech (TTS) systems for the Kazakh language. Dataset Statistics Total Audio Duration: ~726 hours Language: Kazakh (kk) Audio Format: FLAC Sampling Rate: 16kHz… See the full description on the dataset page: https://huggingface.co/datasets/Flamme-VRM/kazakh-speech-dataset.

sourceHugging Facecc-by-4.0updated 9mo agoView on Hugging Face
3likes270downloads
filetrain-00001-of-00036.parquet2.28 GBdownload
filetrain-00003-of-00036.parquet2.19 GBdownload
filetrain-00004-of-00036.parquet2.10 GBdownload
filetrain-00005-of-00036.parquet2.13 GBdownload
filetrain-00006-of-00036.parquet2.09 GBdownload
filetrain-00008-of-00036.parquet2.03 GBdownload
filetrain-00015-of-00036.parquet2.20 GBdownload
filetrain-00017-of-00036.parquet2.13 GBdownload
filetrain-00019-of-00036.parquet2.04 GBdownload
filetrain-00020-of-00036.parquet1.99 GBdownload
filetrain-00021-of-00036.parquet2.05 GBdownload
filetrain-00022-of-00036.parquet2.17 GBdownload
filetrain-00023-of-00036.parquet2.08 GBdownload
filetrain-00024-of-00036.parquet1.94 GBdownload
filetrain-00025-of-00036.parquet1.75 GBdownload
filetrain-00026-of-00036.parquet1.80 GBdownload
filetrain-00027-of-00036.parquet1.86 GBdownload
filetrain-00028-of-00036.parquet2.08 GBdownload
filetrain-00029-of-00036.parquet2.31 GBdownload
filetrain-00031-of-00036.parquet2.95 GBdownload
filetrain-00032-of-00036.parquet2.79 GBdownload
filetrain-00034-of-00036.parquet3.00 GBdownload
filetrain-00035-of-00036.parquet2.58 GBdownload
filetrain-00036-of-00036.parquet165.6 MBdownload

Flamme-VRM/kazakh-speech-dataset · main · files are served by the source, never re-hosted here