CoolFace
Datasetpublic

mesolitica/IMDA-STT

IMDA National Speech Corpus (NSC) Speech-to-Text Originally from https://www.imda.gov.sg/how-we-can-help/national-speech-corpus, this repository simply a mirror. This dataset associated with Singapore Open Data Licence, https://www.sla.gov.sg/newsroom/statistics/singapore-open-data-licence We uploaded mp3 files and compressed using 7z, 7za x part1-mp3.7z.001 All notebooks at https://github.com/mesolitica/malaysian-dataset/tree/master/speech-to-text/imda total… See the full description on the dataset page: https://huggingface.co/datasets/mesolitica/IMDA-STT.

sourceHugging Faceupdated 1y agoView on Hugging Face
6likes1kdownloads
../
fileimda_part1-00000-of-00001.parquet44.2 MBdownload
fileimda_part2-00000-of-00001.parquet33.8 MBdownload
fileimda_part6_1-00000-of-00001.parquet9.4 MBdownload
fileimda_part6_2-00000-of-00001.parquet8.4 MBdownload
fileimda_part6_3-00000-of-00001.parquet8.6 MBdownload
fileimda_same_part3-00000-of-00001.parquet14.0 MBdownload
fileimda_same_part4-00000-of-00001.parquet13.4 MBdownload
fileimda_same_part5-00000-of-00001.parquet5.8 MBdownload
fileimda_separate_part3-00000-of-00001.parquet11.8 MBdownload
fileimda_separate_part4-00000-of-00001.parquet12.4 MBdownload
fileimda_separate_part5-00000-of-00001.parquet20.5 MBdownload

mesolitica/IMDA-STT · main · files are served by the source, never re-hosted here