ud-nlp/arabic-speech-recognition
Arabic Speech Dataset - 10+ hours Dataset comprises over 10 hours of audio featuring 20+ native speakers engaged in telephone-quality dialogues in the Arabic language. It contains high-quality speech data designed for training robust language models and automatic speech recognition systems in real-world conversational scenarios. - Get the data Dataset characteristics: Characteristic Data Description Audio of telephone dialogues in Slovenian for training… See the full description on the dataset page: https://huggingface.co/datasets/ud-nlp/arabic-speech-recognition.
Arabic Speech Dataset - 10+ hours
Dataset comprises over 10 hours of audio featuring 20+ native speakers engaged in telephone-quality dialogues in the Arabic language. It contains high-quality speech data designed for training robust language models and automatic speech recognition systems in real-world conversational scenarios. - [Get the data](https://unidata.pro/datasets/arabic-speech-recognition/?utm_source=huggingface-nlp&utm_medium=referral&utm_campaign=arabic-speech-recognition)
Dataset characteristics:
📊 Sample dataset available! For full access, contact us to discuss purchase terms.
Dataset structure
- audio.mp3 - audio file
- Arabic Speech Recognition.csv - metadata for the data
