tasal9/ZamAi-Pashto-Datasets-V2
ZamAI Cleaned Pashto Dataset V2 Languages: psLicense: apache-2.0Task categories: summarization, text-generation, feature-extractionSize categories: 10K<n<100K Summary This dataset is part of the ZamAI Pashto data collection. It is intended for summarization, text-generation, feature-extraction tasks in Pashto. How to use from datasets import load_dataset dataset = load_dataset("tasal9/ZamAi-Pashto-Datasets-V2") print(dataset) Configs… See the full description on the dataset page: https://huggingface.co/datasets/tasal9/ZamAi-Pashto-Datasets-V2.
ZamAI Cleaned Pashto Dataset V2
Languages: ps License: apache-2.0 Task categories: summarization, text-generation, feature-extraction Size categories: 10K<n<100K
Summary
This dataset is part of the ZamAI Pashto data collection. It is intended for summarization, text-generation, feature-extraction tasks in Pashto.
How to use
from datasets import load_dataset
dataset = load_dataset("tasal9/ZamAi-Pashto-Datasets-V2")
print(dataset)Configs
instruction: load withload_dataset("tasal9/ZamAi-Pashto-Datasets-V2", "instruction")prompt_completion: load withload_dataset("tasal9/ZamAi-Pashto-Datasets-V2", "prompt_completion")
Citation
@misc{zamai_pashto_data,
title = {{ZamAI Cleaned Pashto Dataset V2}},
author = {ZamAI / Yaqoob Tasal},
year = {2024},
howpublished = {\url{https://huggingface.co/datasets/tasal9/ZamAi-Pashto-Datasets-V2}}
}License
This dataset is released under the apache-2.0 license.
