BSC-LT/Legal_Catalan_Spanish_Parallel_Corpus
Dataset Card for Legal Catalan-Spanish Parallel Corpus Dataset Summary The Legal Catalan-Spanish Parallel Corpus is a multilingual dataset of authentic parallel text in Catalan and Spanish from the legal domain, drawn from official Catalan public institution documents. It comprises three sub-corpora organized at different textual granularities: sentence, paragraph, and document level. This multi-level structure enables research and training that goes beyond… See the full description on the dataset page: https://huggingface.co/datasets/BSC-LT/Legal_Catalan_Spanish_Parallel_Corpus.
Upload README.md
Upload README.md
Upload README.md
Rename Legal_Catalan_Spanish_Parallel_Corpus.md to README.md
Delete README.md
Add first dataset card draft
Upload dogc_ca-es.tsv
Upload legal_ca-es_dataset_clean.tsv
Delete legal_ca-es_combined_docx.tsv
Upload legal_ca-es_combined_docx.tsv
initial commit
