CoolFace
Datasetpublic

URajinda/myanmar_spoken_corpus_v4_cleaned

Credits and Acknowledgments This dataset is built upon the foundational work of the Myanmar Spoken Corpus by freococo (Wynn). Original Dataset Source: freococo/myanmar_spoken_corpus Modifications: * Curated and filtered for specific training needs of the ShweYon model. Re-formatted into 36 shards for optimized Continued Pre-training (CPT). We are deeply grateful to freococo for their contribution to the Myanmar AI community by providing this high-quality spoken corpus.

sourceHugging Faceupdated 8mo agoView on Hugging Face
0likes4downloads
Dataset Card

Credits and Acknowledgments This dataset is built upon the foundational work of the Myanmar Spoken Corpus by freococo (Wynn).

Original Dataset Source: freococo/myanmarspokencorpus Modifications: * Curated and filtered for specific training needs of the ShweYon model. Re-formatted into 36 shards for optimized Continued Pre-training (CPT). We are deeply grateful to freococo for their contribution to the Myanmar AI community by providing this high-quality spoken corpus.