CoolFace
Datasetpublic

Llamacha/monolingual-quechua-iic

Dataset Card for Monolingual-Quechua-IIC Dataset Summary We present Monolingual-Quechua-IIC, a monolingual corpus of Southern Quechua, which can be used to build language models using Transformers models. This corpus also includes the Wiki and OSCAR corpora. We used this corpus to build Llama-RoBERTa-Quechua, the first language model for Southern Quechua using Transformers. Supported Tasks and Leaderboards More Information Needed… See the full description on the dataset page: https://huggingface.co/datasets/Llamacha/monolingual-quechua-iic.

sourceHugging Faceapache-2.0updated 4y agoView on Hugging Face
4likes493downloads
settings

This repository belongs to Llamacha on Hugging Face.

CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

namemonolingual-quechua-iic
visibilitypublic
licenceapache-2.0
gatedno
ownerLlamacha
Account settings
Llamacha/monolingual-quechua-iic · CoolFace