CoolFace
Datasetpublic

MaLA-LM/mala-bilingual-translation-corpus

MaLA Corpus: Massive Language Adaptation Corpus This MaLA-LM/mala-bilingual-translation-corpus is the MaLA bilingual translation corpus, collected and processed from various sources. As a part of MaLA Corpus that aims to enhance massive language adaptation in many languages, it contains bilingual translation data (aka, parallel data and bitexts) in 2,500+ language pairs (500+ languages). Key statistics of all language pairs available at… See the full description on the dataset page: https://huggingface.co/datasets/MaLA-LM/mala-bilingual-translation-corpus.

sourceHugging Faceodc-byupdated 2mo agoView on Hugging Face
8likes8.2kdownloads
settings

This repository belongs to MaLA-LM on Hugging Face.

CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

namemala-bilingual-translation-corpus
visibilitypublic
licenceodc-by
gatedno
ownerMaLA-LM
Account settings
MaLA-LM/mala-bilingual-translation-corpus · CoolFace