NightPrince/quran-asr-husary
Quran ASR — Husary Muallim Dataset Description This dataset contains Quran recitation audio files by Sheikh Mahmoud Khalil Al-Husary at 16 kHz sampling rate, with Arabic transcriptions including diacritics. Dataset Structure Audio files: Stored in audio/ folder (e.g., audio/001_001.wav) Data file: manifest.json (NeMo format) Columns: audio_filepath: Path to audio file text: Arabic transcription with diacritics duration: Audio duration in seconds… See the full description on the dataset page: https://huggingface.co/datasets/NightPrince/quran-asr-husary.
Quran ASR — Husary Muallim Dataset
Description
This dataset contains Quran recitation audio files by Sheikh Mahmoud Khalil Al-Husary at 16 kHz sampling rate, with Arabic transcriptions including diacritics.
Dataset Structure
- Audio files: Stored in
audio/folder (e.g.,audio/001_001.wav) - Data file:
manifest.json(NeMo format) - Columns:
audio_filepath: Path to audio filetext: Arabic transcription with diacriticsduration: Audio duration in secondsspeaker: Reciter name
Usage
from datasets import load_dataset
dataset = load_dataset("NightPrince/quran-asr-husary")
sample = dataset["train"][0]
# Load audio for playback/processing
import librosa
audio, sr = librosa.load(f"https://huggingface.co/datasets/NightPrince/quran-asr-husary/resolve/main/{sample['audio_filepath']}")