IbrahimDayax/somali-combined-asr-stt-dataset
Somali Combined ASR/STT Dataset A Somali automatic speech recognition (ASR) / speech-to-text (STT) dataset combining synthetic TTS-generated audio and other Somali speech sources, deduplicated by transcript text and split into train/validation/test. Dataset Summary Language: Somali (so) Task: Automatic Speech Recognition / Speech-to-Text Audio format: WAV, 16 kHz mono Total examples: 8,226 (after deduplication) Total audio: ~6 hours Split Examples Audio… See the full description on the dataset page: https://huggingface.co/datasets/IbrahimDayax/somali-combined-asr-stt-dataset.
Upload README.md with huggingface_hub
Remove old raw duplicated audio/manifests (batch 39/39)
Remove old raw duplicated audio/manifests (batch 38/39)
Remove old raw duplicated audio/manifests (batch 37/39)
Remove old raw duplicated audio/manifests (batch 36/39)
Remove old raw duplicated audio/manifests (batch 35/39)
Remove old raw duplicated audio/manifests (batch 34/39)
Remove old raw duplicated audio/manifests (batch 33/39)
Remove old raw duplicated audio/manifests (batch 32/39)
Remove old raw duplicated audio/manifests (batch 31/39)
Remove old raw duplicated audio/manifests (batch 30/39)
Remove old raw duplicated audio/manifests (batch 29/39)
Remove old raw duplicated audio/manifests (batch 28/39)
Remove old raw duplicated audio/manifests (batch 27/39)
Remove old raw duplicated audio/manifests (batch 26/39)
Remove old raw duplicated audio/manifests (batch 25/39)
Remove old raw duplicated audio/manifests (batch 24/39)
Remove old raw duplicated audio/manifests (batch 23/39)
Remove old raw duplicated audio/manifests (batch 22/39)
Remove old raw duplicated audio/manifests (batch 21/39)
Remove old raw duplicated audio/manifests (batch 20/39)
Remove old raw duplicated audio/manifests (batch 19/39)
Remove old raw duplicated audio/manifests (batch 18/39)
Remove old raw duplicated audio/manifests (batch 17/39)
Remove old raw duplicated audio/manifests (batch 16/39)
Remove old raw duplicated audio/manifests (batch 15/39)
Remove old raw duplicated audio/manifests (batch 14/39)
Remove old raw duplicated audio/manifests (batch 13/39)
Remove old raw duplicated audio/manifests (batch 12/39)
Remove old raw duplicated audio/manifests (batch 11/39)
Remove old raw duplicated audio/manifests (batch 10/39)
Remove old raw duplicated audio/manifests (batch 9/39)
Remove old raw duplicated audio/manifests (batch 8/39)
Remove old raw duplicated audio/manifests (batch 7/39)
Remove old raw duplicated audio/manifests (batch 6/39)
Remove old raw duplicated audio/manifests (batch 5/39)
Remove old raw duplicated audio/manifests (batch 4/39)
Remove old raw duplicated audio/manifests (batch 3/39)
Remove old raw duplicated audio/manifests (batch 2/39)
Remove old raw duplicated audio/manifests (batch 1/39)
Upload dataset
Remove stale duplicate flat files (batch 5)
Remove stale duplicate flat files (batch 4)
Remove stale duplicate flat files (batch 3)
Remove stale duplicate flat files (batch 2)
Remove stale duplicate flat files (batch 1)
Upload dataset_info.json with huggingface_hub
Upload folder using huggingface_hub
Upload folder using huggingface_hub
Upload folder using huggingface_hub (part 75)
