CoolFace
Datasetpublic

tasal9/ZamAI-Pashto-MegaDataset-v1

ZamAI Pashto Mega Dataset v1 Languages: psLicense: apache-2.0Task categories: text-generation, summarization, question-answeringSize categories: 10K<n<100K Summary This dataset is part of the ZamAI Pashto data collection. It is intended for text-generation, summarization, question-answering tasks in Pashto. How to use from datasets import load_dataset dataset = load_dataset("tasal9/ZamAI-Pashto-MegaDataset-v1") print(dataset) Configs… See the full description on the dataset page: https://huggingface.co/datasets/tasal9/ZamAI-Pashto-MegaDataset-v1.

sourceHugging Faceapache-2.0updated 2mo agoView on Hugging Face
0likes25downloads
Dataset Card

ZamAI Pashto Mega Dataset v1

Languages: ps License: apache-2.0 Task categories: text-generation, summarization, question-answering Size categories: 10K<n<100K

Summary

This dataset is part of the ZamAI Pashto data collection. It is intended for text-generation, summarization, question-answering tasks in Pashto.

How to use

python
from datasets import load_dataset

dataset = load_dataset("tasal9/ZamAI-Pashto-MegaDataset-v1")
print(dataset)

Configs

  • default: load with load_dataset("tasal9/ZamAI-Pashto-MegaDataset-v1", "default")

Citation

bibtex
@misc{zamai_pashto_data,
  title = {{ZamAI Pashto Mega Dataset v1}},
  author = {ZamAI / Yaqoob Tasal},
  year = {2024},
  howpublished = {\url{https://huggingface.co/datasets/tasal9/ZamAI-Pashto-MegaDataset-v1}}
}

License

This dataset is released under the apache-2.0 license.