CoolFace
Datasetpublic

lindonghello/omnilingual-asr-corpus

Meta Omnilingual ASR Corpus The Omnilingual ASR Corpus is a collection of spontaneous speech recordings and their transcriptions for 348 under-served languages. The corpus was collected as part of Meta FAIR’s Omnilingual ASR project (blog, model, paper) for the purposes of training automatic speech recognition (ASR) and spoken language identification models. Data schema { `language`: "lij_Latn", `iso_639_3`: "lij", `iso_15924`: "Latn"… See the full description on the dataset page: https://huggingface.co/datasets/lindonghello/omnilingual-asr-corpus.

sourceHugging Facecc-by-4.0updated 5mo agoView on Hugging Face
0likes118downloads
1 commits on main
afef90b5mo ago

Duplicate from facebook/omnilingual-asr-corpus

lindonghello, meta-bot