MR3z4/persian-accents-benchmark
Persian Accents Benchmark Dataset Summary A benchmark for Persian automatic speech recognition (ASR): 279 short utterances of informal Persian (Farsi) dialect speech across 16 regional accents, released as a fixed evaluation set. Total audio duration is approximately 4.4 hours. The primary label is the transcription; each utterance also carries an accent label (usable for accent classification as a secondary task) and an emotion label as auxiliary metadata. This… See the full description on the dataset page: https://huggingface.co/datasets/MR3z4/persian-accents-benchmark.
Reframe as ASR benchmark with accent classification as secondary task
Add README.md
Add metadata.csv
Add yazdi audio (23 files)
Add torki audio (9 files)
Add tajiki audio (15 files)
Add shirazi audio (17 files)
Add qomi audio (10 files)
Add qazvini audio (1 files)
Add mazandarani audio (28 files)
Add lori audio (3 files)
Add kordi audio (19 files)
Add khuzestani audio (24 files)
Add khorasani audio (20 files)
Add kermani audio (13 files)
Add gilani audio (31 files)
Add esfahani audio (16 files)
Add bushehri audio (9 files)
Add balochi audio (41 files)
initial commit
