Oriolshhh/parlabe-errors-varis-450k
Dataset mixt de correcció gramatical en català (450.000 parelles) Aquest dataset conté 450.000 parelles de frases en format: text_erroni,text_correcte Està pensat per entrenar models de correcció gramatical robusta en català, abastant una àmplia gamma d’errors habituals, tant d’aprenents com de parlants nadius o transcripcions automàtiques. Tipus d’errors inclosos Aquestes parelles cobreixen diferents tipus d’errors sintètics generats controladament:… See the full description on the dataset page: https://huggingface.co/datasets/Oriolshhh/parlabe-errors-varis-450k.
Conversations for this repository live on Hugging Face.
CoolFace shows imported repositories read-only. Posting into someone else’s repository from here would need an authorised integration and the account holder’s consent, so the link goes to the source instead.
Open discussions on Hugging Face