CoolFace
30 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01edifier99 /sinhala-openslr-111haudio100K<n<1M0 likes248 downloads4mo agoHugging Face02SPEAK-ASR /openslr-sinhala-asr-normaudio10K<n<100K0 likes201 downloads7mo agoHugging Face03irudachirath /large-sinhala-asr-datasetaudio100K<n<1M1 likes198 downloads1y agoHugging Face04SPEAK-ASR /openslr-sinhala-asraudio100K<n<1M2 likes198 downloads7mo agoHugging Face05outlawmold /sinhala-tts-dataset-archive-20260429-082457 Sinhala TTS Dataset Clean, segmented Sinhala speech from the "Unlimited History" YouTube series by @sunchare. Stats Metric Value Utterances 218 Train 208 Val 10 Hours 0.51 Mean duration 8.5s Sample rate 22050 Hz Pipeline Raw YouTube audio -> HTDemucs -> VoiceFixer + DeepFilterNet3 -> Diarization -> Silero-VAD -> ASR (faster-whisper: C:\Users\kosal\sinhala-tts\whisper-small-si-ct2) -> Quality filtering (SNR>=20.0dB) Format… See the full description on the dataset page: https://huggingface.co/datasets/outlawmold/sinhala-tts-dataset-archive-20260429-082457.audiotext-to-speechn<1K0 likes161 downloads5mo agoHugging Face06SPEAK-ASR /openslr-sinhala-asr-depricated-versionaudio100K<n<1M0 likes160 downloads9mo agoHugging Face07Ransaka /SinhalaASR-testaudio10K<n<100K1 likes114 downloads3y agoHugging Face08Ransaka /sinhala-ctc-111haudio100K<n<1M0 likes103 downloads11h agoHugging Face09Ransaka /SinhalaASR-1000audio1K<n<10K2 likes101 downloads3y agoHugging Face10outlawmold /sinhala-tts-raw-audioaudion<1K0 likes93 downloads5mo agoHugging Face11Lingalingeswaran /asr-sinhala-dataset_check1_modifiedaudio10K<n<100K0 likes48 downloads2y agoHugging Face12SPEAK-ASR /youtube-sinhala-asraudio1K<n<10K0 likes36 downloads7mo agoHugging Face13Lingalingeswaran /asr-sinhala-dataset_json_v1audio10K<n<100K1 likes34 downloads2y agoHugging Face14Ransaka /sinhala-ctc-111h-10kaudio10K<n<100K0 likes32 downloads11h agoHugging Face15Lingalingeswaran /hifigan-sinhalaaudio1K<n<10K0 likes30 downloads1y agoHugging Face16Lingalingeswaran /asr-sinhala-dataset_json_v2audio10K<n<100K0 likes23 downloads2y agoHugging Face17eshangj /SinhalaTTSaudion<1K0 likes20 downloads1y agoHugging Face18Lingalingeswaran /combined_tamil_english_sinhalaaudio1K<n<10K0 likes19 downloads1y agoHugging Face19IshanSuga /sinhala-bank-speech Dataset Card for Dataset Name This dataset card aims to be a base template for new datasets. It has been generated using this raw template. Dataset Details Dataset Description This dataset contains 100 audio files, one male voice in the format .wav. The domain of this dataset is Banking.Only Language is Sinhalese(Sinhala,si) Total Duration: 700.283 seconds. Curated by: [More Information Needed] Funded by [optional]: [More Information Needed] Shared by… See the full description on the dataset page: https://huggingface.co/datasets/IshanSuga/sinhala-bank-speech.audioautomatic-speech-recognitionn<1K0 likes16 downloads2y agoHugging Face20pavi1561 /Sinhala_speech_to_textaudioautomatic-speech-recognition10K<n<100K0 likes15 downloads2y agoHugging Face21irudachirath /multi-speaket-tts-dataset-sinhalaaudio1K<n<10K1 likes14 downloads1y agoHugging Face22SPEAK-ASR /biz-brains-academy-sinhalaaudion<1K0 likes14 downloads8mo agoHugging Face23SPEAK-ASR /openslr-sinhala-asr-norm-noise-remaudio10K<n<100K0 likes14 downloads7mo agoHugging Face24Evan888sdklfadklshfdjklsuf /sinhala-noisy-datasetaudio10K<n<100K0 likes14 downloads3mo agoHugging Face25Ransaka /ASR-Sinhala-Cleanedaudio10K<n<100K0 likes13 downloads2y agoHugging Face26jithara /sinhala-emotional-tts-datasetaudion<1K0 likes12 downloads7mo agoHugging Face27ehzawad /sinhala-emotion-dataset Sinhala Emotion Dataset A comprehensive dataset for Sinhala speech emotion recognition containing 2,999 audio samples with corresponding text transcriptions. Dataset Overview This dataset contains emotional speech samples in Sinhala (Sinhalese), the primary language of Sri Lanka. Each sample includes high-quality audio recordings with their corresponding text transcriptions, making it suitable for various speech and emotion recognition tasks. Key Features… See the full description on the dataset page: https://huggingface.co/datasets/ehzawad/sinhala-emotion-dataset.audio1K<n<10K0 likes11 downloads1y agoHugging Face28Lingalingeswaran /asr-sinhala-dataset_v4audio10K<n<100K0 likes10 downloads2y agoHugging Face29Lingalingeswaran /combined_english_sinhalaaudio1K<n<10K0 likes10 downloads1y agoHugging Face30IAmNotAnanth /sinhala-ctc-111hgated Sinhala ASR – Consolidated OpenSLR (SLR52) Dataset Summary This dataset is a consolidated and cleaned version of the Sinhala Automatic Speech Recognition (ASR) dataset from OpenSLR (SLR52). The original OpenSLR release distributes the data across multiple subsets (0–9, a–f). This repository merges all subsets into a single unified dataset containing approximately 111 hours of speech audio. Dataset Description Consolidation All OpenSLR SLR52… See the full description on the dataset page: https://huggingface.co/datasets/IAmNotAnanth/sinhala-ctc-111h.audioautomatic-speech-recognition100K<n<1M0 likes9 downloads9mo agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.