CoolFace
Datasetpublic

Oriolshhh/parlabe-error-correccio-traduccions-1m

Dataset sintètic de parelles error-correcció (1M) Aquest dataset conté 1.111.000 parelles de frases en format: text_erroni,text_correcte Està dissenyat per a l'entrenament de models de correcció gramatical i semàntica en català. Com s'ha generat? A partir del dataset anglès C4_200M Synthetic, cada frase s'ha traduït al català dues vegades: Frase correcta: traduïda amb softcatala/translate-eng-cat, que manté estructura i sentit correctes. Frase errònia: traduïda… See the full description on the dataset page: https://huggingface.co/datasets/Oriolshhh/parlabe-error-correccio-traduccions-1m.

sourceHugging Faceapache-2.0updated 1y agoView on Hugging Face
0likes22downloads
3 commits on main
f8a3b0d1y ago

Upload parelles_error_correccio_translated.csv with huggingface_hub

Oriolshhh
dbb97671y ago

Update README.md

Oriolshhh
3432d2d1y ago

initial commit

Oriolshhh