Oriolshhh/parlabe-error-correccio-traduccions-1m
Dataset sintètic de parelles error-correcció (1M) Aquest dataset conté 1.111.000 parelles de frases en format: text_erroni,text_correcte Està dissenyat per a l'entrenament de models de correcció gramatical i semàntica en català. Com s'ha generat? A partir del dataset anglès C4_200M Synthetic, cada frase s'ha traduït al català dues vegades: Frase correcta: traduïda amb softcatala/translate-eng-cat, que manté estructura i sentit correctes. Frase errònia: traduïda… See the full description on the dataset page: https://huggingface.co/datasets/Oriolshhh/parlabe-error-correccio-traduccions-1m.
022
Upload parelles_error_correccio_translated.csv with huggingface_hub
Update README.md
initial commit
