CoolFace
Datasetpublic

gplsi/uji_parallel_va_en

UJI_PARALLEL_VA_EN Dataset Dataset Summary UJI_PARALLEL_VA_EN is a parallel dataset for machine translation between Valencian (VA) and English (EN).It consists of aligned sentence pairs along with the source file from which each pair was extracted.The dataset is intended for research in machine translation, cross-lingual NLP, and linguistic analysis. Dataset Structure Each row in the dataset includes the following fields: VA: A sentence in… See the full description on the dataset page: https://huggingface.co/datasets/gplsi/uji_parallel_va_en.

sourceHugging Facecc-by-4.0updated 4mo agoView on Hugging Face
0likes20downloads
15 commits on main
2206aab4mo ago

Update README.md

jpconsuegra
f31cb265mo ago

Update README.md

jpconsuegra
c5c47f47mo ago

Delete train

jpconsuegra
0d321807mo ago

Upload data/train/va-en-sentence.length.ner.curated.jsonl with huggingface_hub

jpconsuegra
d1b1c5b7mo ago

Upload data/train/va-en-paragraph.length.curated.jsonl with huggingface_hub

jpconsuegra
57061ce7mo ago

Upload data/train/va-en-documents.curated.jsonl with huggingface_hub

jpconsuegra
7b593849mo ago

Update README.md

jpconsuegra
08cab709mo ago

Update README.md

jpconsuegra
ae5202910mo ago

Delete va-en-paragraphs.jsonl

jpconsuegra
bb752bc10mo ago

Delete train.jsonl

jpconsuegra
2369b2d10mo ago

Upload 2 files

jpconsuegra
188104710mo ago

Upload va-en-paragraphs.jsonl

jpconsuegra
1e7289f10mo ago

Upload train.jsonl

jpconsuegra
0ac575310mo ago

Update README.md

jpconsuegra
85ca3e210mo ago

initial commit

jpconsuegra