CoolFace
12 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01mesolitica /pseudolabel-science-large-v3-timestamp Pseudolabel science context audio using Whisper Large V3 Original audio from malaysia-ai/science-context-youtube, we split every 30 seconds and pseudolabelled using Whisper Large V3. how to prepare the dataset huggingface-cli download --repo-type dataset \ --include 'science-chunk-*.zip' \ --local-dir './' \ --max-workers 20 \ mesolitica/pseudolabel-science-large-v3-timestamp wget… See the full description on the dataset page: https://huggingface.co/datasets/mesolitica/pseudolabel-science-large-v3-timestamp.audio100K<n<1M0 likes1k downloads1y agoHugging Face02Aynursusuz /Healty-Science-3audion<1K0 likes1k downloads10mo agoHugging Face03Aynursusuz /Healty-Science-1audion<1K0 likes911 downloads10mo agoHugging Face04Aynursusuz /Healty-Science-2audion<1K0 likes884 downloads10mo agoHugging Face05Aynursusuz /Healty-Science-5audion<1K0 likes859 downloads9mo agoHugging Face06Aynursusuz /Healty-Science-4audion<1K0 likes511 downloads10mo agoHugging Face07Aynursusuz /Healty-Science-6audion<1K0 likes184 downloads10mo agoHugging Face08Data-Science-Nigeria /voice-of-care-health-dataset Voice of Care AI for Global Health Benchmark Dataset Overview This dataset contains spoken Hausa Health datasets with rich annotations covering emotion, intent, speaker demographics, and dialect variation, intended for speech and NLP research. Dataset Summary Property Details Language Hausa Modality Audio + Text Task(s) e.g. Speech Recognition, Emotion Detection, Dialect Identification Version 1.0.0 🛠️ Dataset… See the full description on the dataset page: https://huggingface.co/datasets/Data-Science-Nigeria/voice-of-care-health-dataset.audioautomatic-speech-recognition10K<n<100K1 likes81 downloads2mo agoHugging Face09tvidzx /sher-data-ana-scienceaudion<1K0 likes29 downloads1mo agoHugging Face10Achitha /10th_science_tamil_to_englishThe data contains roughly one and half hours of audio and transcripts in Tamil language.audio1K<n<10K0 likes23 downloads4y agoHugging Face11smfreeze /free-science-lessons-donellySub to Tubular Pickaxe audion<1K0 likes17 downloads3y agoHugging Face12Vyvo /AST-Speech-Healty-and-Sciencegatedaudio1K<n<10K0 likes2 downloads10mo agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.