freococo/rohingya_asr_audio
This is the first public Rohingya language ASR dataset in AI history. Overview This dataset contains broadcast audio recordings from the Voice of America (VOA) Rohingya Service. Each file represents a daily news segment, typically 30 minutes in length, automatically segmented into chunks of 5–15 seconds for use in self-supervised ASR, pretraining, language identification, and more. The content was aired publicly as part of VOA’s Rohingya-language radio program and is therefore… See the full description on the dataset page: https://huggingface.co/datasets/freococo/rohingya_asr_audio.
Upload train/rohingya-00013.tar with huggingface_hub
Upload train/rohingya-00012.tar with huggingface_hub
Upload train/rohingya-00011.tar with huggingface_hub
Upload train/rohingya-00010.tar with huggingface_hub
Upload train/rohingya-00009.tar with huggingface_hub
Upload train/rohingya-00008.tar with huggingface_hub
Upload train/rohingya-00007.tar with huggingface_hub
Upload train/rohingya-00006.tar with huggingface_hub
Upload train/rohingya-00005.tar with huggingface_hub
Upload train/rohingya-00004.tar with huggingface_hub
Upload train/rohingya-00003.tar with huggingface_hub
Upload train/rohingya-00002.tar with huggingface_hub
Upload train/rohingya-00001.tar with huggingface_hub
Upload train/rohingya-00000.tar with huggingface_hub
Delete train
Update README.md
Upload train/rohingya-00000.tar with huggingface_hub
Update README.md
Update README.md
Delete train
Upload train/rohingya-00000.tar with huggingface_hub
Update README.md
Update README.md
Delete train
Upload train/rohingya-00001.tar with huggingface_hub
Update README.md
Update README.md
initial commit
