ScandLM/nynorsk_culturax
Nynorsk Culturax Dataset This dataset is simply a reformatting of uonlp/CulturaX. Some minor formatting errors have been corrected. Usage from datasets import load_dataset dataset = load_dataset("ScandLM/nynorsk_culturax")
Upload src/upload_culturax.py with huggingface_hub
Upload src/download_culturax.py with huggingface_hub
Upload README.md with huggingface_hub
Upload jsonl/cleaned_nynorsk_culturax.jsonl with huggingface_hub
Upload data/train-00000-of-00001.parquet with huggingface_hub
Upload src/upload_culturax.py with huggingface_hub
Upload src/download_culturax.py with huggingface_hub
Upload README.md with huggingface_hub
Upload jsonl/cleaned_nynorsk_culturax.jsonl with huggingface_hub
Upload data/train-00000-of-00001.parquet with huggingface_hub
Upload src/upload_culturax.py with huggingface_hub
Upload src/download_culturax.py with huggingface_hub
Upload README.md with huggingface_hub
Upload jsonl/cleaned_nynorsk_culturax.jsonl with huggingface_hub
Upload data/train-00000-of-00001.parquet with huggingface_hub
initial commit
