CoolFace
Datasetpublic

Llamacha/monolingual-quechua-iic

Dataset Card for Monolingual-Quechua-IIC Dataset Summary We present Monolingual-Quechua-IIC, a monolingual corpus of Southern Quechua, which can be used to build language models using Transformers models. This corpus also includes the Wiki and OSCAR corpora. We used this corpus to build Llama-RoBERTa-Quechua, the first language model for Southern Quechua using Transformers. Supported Tasks and Leaderboards More Information Needed… See the full description on the dataset page: https://huggingface.co/datasets/Llamacha/monolingual-quechua-iic.

sourceHugging Faceapache-2.0updated 4y agoView on Hugging Face
4likes493downloads

Llamacha/monolingual-quechua-iic · main · files are served by the source, never re-hosted here