CoolFace
Datasetpublic

bilguun/cv-mn-24.0

cv-mn-24.0 Mongolian subset of the Mozilla Common Voice speech recognition dataset. Dataset Statistics Total samples: 6,018Total duration: 9h 7m 2s (9.12 h) Per-split breakdown Split Samples Total Duration Avg Duration train 2,188 3h 7m 34s (3.13 h) 5.14 s validation 1,896 2h 54m 41s (2.91 h) 5.53 s test 1,934 3h 4m 47s (3.08 h) 5.73 s

sourceHugging Faceupdated 5mo agoView on Hugging Face
1likes41downloads
Dataset Card

cv-mn-24.0

Mongolian subset of the Mozilla Common Voice speech recognition dataset.

Dataset Statistics

Total samples: 6,018 Total duration: 9h 7m 2s (9.12 h)

Per-split breakdown

SplitSamplesTotal DurationAvg Duration
train2,1883h 7m 34s (3.13 h)5.14 s
validation1,8962h 54m 41s (2.91 h)5.53 s
test1,9343h 4m 47s (3.08 h)5.73 s