BSC-LT/Spanish-Valencian_Catalan_Parallel_Corpus
Dataset Card for Spanish-Valencian Catalan Parallel Corpus Dataset Summary A bilingual parallel corpus containing parallel sentences in Spanish and the Valencian variant of Catalan. Built by aggregating and filtering multiple public sources, along with data obtained through direct data sharing with external partners, it provides sentence-level alignments for training Machine Translation systems. The dataset includes both authentically parallel data as well as… See the full description on the dataset page: https://huggingface.co/datasets/BSC-LT/Spanish-Valencian_Catalan_Parallel_Corpus.
Update data sources, acknowledgements, and license
Upload README.md
Upload .txt files
Upload ca_va-es.parquet
Delete vl-es.parquet
Upload vl-es.parquet
initial commit
