alakxender/dhivehi-audios-ds1
Dhivehi Audio Dataset 1 A quality-filtered Dhivehi speech dataset with three subsets (bronze, silver, gold), each representing a progressively stricter quality threshold. Subsets Subset MOS CTC gc WER Train Test bronze ≥3.0 ≥0.70 — 224,321 24,925 silver ≥3.0 ≥0.70 ≤0.30 131,389 14,599 gold ≥3.5 ≥0.75 ≤0.20 15,535 1,727 MOS — Mean Opinion Score (1–4), subjective listening quality rating CTC gc — CTC forced-alignment geo-confidence (0–1)… See the full description on the dataset page: https://huggingface.co/datasets/alakxender/dhivehi-audios-ds1.
07
No card is published for this repository, or it could not be fetched from Hugging Face right now.
