Oriolshhh/parlabe-errors-varis-450k
Dataset mixt de correcció gramatical en català (450.000 parelles) Aquest dataset conté 450.000 parelles de frases en format: text_erroni,text_correcte Està pensat per entrenar models de correcció gramatical robusta en català, abastant una àmplia gamma d’errors habituals, tant d’aprenents com de parlants nadius o transcripcions automàtiques. Tipus d’errors inclosos Aquestes parelles cobreixen diferents tipus d’errors sintètics generats controladament:… See the full description on the dataset page: https://huggingface.co/datasets/Oriolshhh/parlabe-errors-varis-450k.
This repository belongs to Oriolshhh on Hugging Face.
CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.
