CoolFace
Datasetpublic

michsethowusu/english-tumbuka_sentence-pairs_mt560

English-Tumbuka Parallel Dataset This dataset contains parallel sentences in English and Tumbuka (Malawi). Dataset Information Language Pair: English ↔ Tumbuka Language Code: tum Country: Malawi Original Source: OPUS MT560 Dataset Dataset Structure The dataset contains parallel sentences that can be used for: Machine translation training Cross-lingual NLP tasks Language model fine-tuning Citation If you use this dataset, please… See the full description on the dataset page: https://huggingface.co/datasets/michsethowusu/english-tumbuka_sentence-pairs_mt560.

sourceHugging Facecc-by-4.0updated 1y agoView on Hugging Face
0likes20downloads
3 commits on main
0821b971y ago

Upload README.md with huggingface_hub

michsethowusu
13138561y ago

Upload dataset

michsethowusu
e6e85c61y ago

initial commit

michsethowusu