projecte-aina/escagleu-64k
Dataset Card for escagleu-64K corpus Dataset Description Dataset Summary This is the second version of escagleu-64k, a parallel corpus containing approximately 64k sentences translated across Spanish, Catalan, Valencian Catalan, Galician, and Basque. The original sentences are in Spanish and are sourced from the Spanish Common Voice Corpus. This corpus was prepared with the goal of creating a parallel speech dataset for these languages using the… See the full description on the dataset page: https://huggingface.co/datasets/projecte-aina/escagleu-64k.
Rename escagleu_64k_gl.tsv to escagleu-64k_gl-v2.tsv
Rename escagleu_64k_eu.tsv to escagleu-64k_eu-v2.tsv
Rename escagleu_64k_es.tsv to escagleu-64k_es-v2.tsv
Rename escagleu_64k_ca_va.tsv to escagleu-64k_ca_va-v2.tsv
Rename escagleu_64k_ca.tsv to escagleu-64k_ca-v2.tsv
Rename escagleu_64k.tsv to escagleu-64k-v2.tsv
Rename escagleu-64k_gl.tsv to escagleu-64k_gl-v1.tsv
Rename escagleu-64k_eu.tsv to escagleu-64k_eu-v1.tsv
Rename escagleu-64k_es.tsv to escagleu-64k_es-v1.tsv
Rename escagleu-64k_ca_va.tsv to escagleu-64k_ca_va-v1.tsv
Rename escagleu-64k_ca.tsv to escagleu-64k_ca-v1.tsv
Rename escagleu-64k.tsv to escagleu-64k-v1.tsv
Update README.md (#2)
v2 (#3)
Update README.md
Update README.md
Upload README.md (#4)
Update README.md (#1)
Update README.md
Update README.md
new alignment
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Upload 2 files
Upload 5 files
initial commit
