CoolFace
Datasetpublic

NightPrince/quran-asr-husary

Quran ASR — Husary Muallim Dataset Description This dataset contains Quran recitation audio files by Sheikh Mahmoud Khalil Al-Husary at 16 kHz sampling rate, with Arabic transcriptions including diacritics. Dataset Structure Audio files: Stored in audio/ folder (e.g., audio/001_001.wav) Data file: manifest.json (NeMo format) Columns: audio_filepath: Path to audio file text: Arabic transcription with diacritics duration: Audio duration in seconds… See the full description on the dataset page: https://huggingface.co/datasets/NightPrince/quran-asr-husary.

sourceHugging Facecc-by-4.0updated 6mo agoView on Hugging Face
0likes182downloads
Dataset Card

Quran ASR — Husary Muallim Dataset

Description

This dataset contains Quran recitation audio files by Sheikh Mahmoud Khalil Al-Husary at 16 kHz sampling rate, with Arabic transcriptions including diacritics.

Dataset Structure

  • —Audio files: Stored in audio/ folder (e.g., audio/001_001.wav)
  • —Data file: manifest.json (NeMo format)
  • —Columns:
  • —audio_filepath: Path to audio file
  • —text: Arabic transcription with diacritics
  • —duration: Audio duration in seconds
  • —speaker: Reciter name

Usage

python
from datasets import load_dataset

dataset = load_dataset("NightPrince/quran-asr-husary")
sample = dataset["train"][0]

# Load audio for playback/processing
import librosa
audio, sr = librosa.load(f"https://huggingface.co/datasets/NightPrince/quran-asr-husary/resolve/main/{sample['audio_filepath']}")