CoolFace
30 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01Mawube /s2tt-yoruba-englishaudio10K<n<100K0 likes264 downloads6mo agoHugging Face02Mawube /s2tt-igbo-englishaudio10K<n<100K0 likes214 downloads6mo agoHugging Face03Mawube /s2tt-hausa-englishaudio10K<n<100K0 likes174 downloads6mo agoHugging Face04NgQuocThai /S2T_Split_NoRom_phase2audio10K<n<100K0 likes123 downloads11mo agoHugging Face05PThi35 /S2T_Korean_Merge_2_fixed4audio10K<n<100K0 likes116 downloads5mo agoHugging Face06thevan2404 /S2T_English_Vietnamese_AuVi_2audio1K<n<10K0 likes68 downloads1y agoHugging Face07PThi35 /S2T_Korean_limit_silent_spaceaudio10K<n<100K0 likes36 downloads5mo agoHugging Face08japanese-asr /en2ja.s2t_translationaudio10K<n<100K2 likes30 downloads2y agoHugging Face09PThi35 /S2T_Korean_Merge_2_fixed2audio10K<n<100K0 likes27 downloads5mo agoHugging Face10japanese-asr /ja2en.s2t_translationaudio1K<n<10K1 likes20 downloads2y agoHugging Face11PThi35 /S2T_Korean_3s_silentaudio10K<n<100K0 likes17 downloads3mo agoHugging Face12oscowlai /S2TTaudio10K<n<100K0 likes16 downloads6mo agoHugging Face13thevan2404 /S2T_English_Vietnamese_AuVi_testaudion<1K0 likes11 downloads1y agoHugging Face14PThi35 /S2T_Korean_Mergeaudio10K<n<100K0 likes8 downloads5mo agoHugging Face15kneth90 /s2tkp_dataset_part_3audion<1K0 likes6 downloads2y agoHugging Face16Kaushalb11 /multi-lang-s2t-dataset Multi-Language Audio Dataset A high-quality, cleaned audio dataset derived from five AI4Bharat sources, containing speech-to-text data in Hindi, Gujarati, and Telugu with English translations. Dataset Overview Language Duration (Hours) Hindi 55.45 Gujarati 42.12 Telugu 37.83 Total Duration: ~135 hours of cleaned, high-quality audio Source Datasets Data collected and cleaned from: ai4bharat/IndicVoices-ST ai4bharat/NPTEL… See the full description on the dataset page: https://huggingface.co/datasets/Kaushalb11/multi-lang-s2t-dataset.audion<1K0 likes5 downloads9mo agoHugging Face17ygyuan /kws_testset_zh_s2tgated ygyuan/kws_testset_zh_s2t Keyword-Spotting (KWS) speech dataset, packed as WebDataset tar shards. The input is a Kaldi-style data directory (wav.scp, text, utt2spk, utt2dur, segments), where each utterance is packed as a single tar sample. Layout data/ <split>/ metadata.csv audio/ <split>-000.tar <split>-001.tar ... Shard counts: test: 12 tar shard(s) Inside each tar, every sample is a pair sharing a unique key: <key>.wav # raw… See the full description on the dataset page: https://huggingface.co/datasets/ygyuan/kws_testset_zh_s2t.audioaudio-classification0 likes5 downloads2mo agoHugging Face18NgQuocThai /S2T_Splited_Finalgatedaudio10K<n<100K0 likes3 downloads1y agoHugging Face19NgQuocThai /S2T_SplitEndMoviegatedaudio10K<n<100K0 likes3 downloads1y agoHugging Face20PThi35 /S2T_Korean_Merge_2_fixedaudio10K<n<100K0 likes3 downloads5mo agoHugging Face21PThi35 /S2T_Korean_Merge_2_fixed3audio10K<n<100K0 likes3 downloads5mo agoHugging Face22NgQuocThai /S2T_Splited_Gameshowgatedaudio1K<n<10K0 likes2 downloads1y agoHugging Face23NgQuocThai /S2T_SplitEndMovie_Sentencesgatedaudio10K<n<100K0 likes2 downloads1y agoHugging Face24NgQuocThai /S2T_Split_30sgatedaudio10K<n<100K0 likes2 downloads1y agoHugging Face25kneth90 /s2tkp_dataset_part_1gatedaudio1K<n<10K0 likes1 downloads2y agoHugging Face26kneth90 /s2tkp_dataset_part_2gatedaudio1K<n<10K0 likes1 downloads2y agoHugging Face27NgQuocThai /S2T_Mergedgatedaudio10K<n<100K0 likes1 downloads1y agoHugging Face28NgQuocThai /S2T_Merged_Sentencesgatedaudio10K<n<100K0 likes1 downloads1y agoHugging Face29NgQuocThai /S2T_Split_Sentencesgatedaudio10K<n<100K0 likes1 downloads1y agoHugging Face30NgQuocThai /S2T_Merged_25sgatedaudio10K<n<100K0 likes1 downloads1y agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.