CoolFace
Datasetpublic

michsethowusu/english-tumbuka_sentence-pairs_mt560

English-Tumbuka Parallel Dataset This dataset contains parallel sentences in English and Tumbuka (Malawi). Dataset Information Language Pair: English ↔ Tumbuka Language Code: tum Country: Malawi Original Source: OPUS MT560 Dataset Dataset Structure The dataset contains parallel sentences that can be used for: Machine translation training Cross-lingual NLP tasks Language model fine-tuning Citation If you use this dataset, please… See the full description on the dataset page: https://huggingface.co/datasets/michsethowusu/english-tumbuka_sentence-pairs_mt560.

sourceHugging Facecc-by-4.0updated 1y agoView on Hugging Face
0likes20downloads

michsethowusu/english-tumbuka_sentence-pairs_mt560 · main · files are served by the source, never re-hosted here