datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
multi_ds_asiaAsian-High-Fidelity-ASR-Dataset
Dataset Overview
This dataset contains high-quality conversational audio samples curated for Automatic Speech Recognition tasks in Vietnamese, Korean, Arabic and Filipino.
The dataset includes:
Paired audio + transcripts
Natural, non-scripted conversational speech
Single-speaker & Dual-speaker interactions
Audio Specifications
Sampling Rate: 16 kHz – 24 kHz
Bit Depth: 16-bit
Audio Type: Non-scripted conversational speech
Supported Languages
Language… See the full description on the dataset page: https://huggingface.co/datasets/humyn-labs/Asian-High-Fidelity-ASR-Dataset.fleurs_south_asia_mini
