CoolFace
Datasetpublic

DatarrX/tipitaka-dataset

Myanmar Tipitaka Dataset (Pali Corpus) Dataset Summary The Myanmar Tipitaka Dataset is a high-quality, structured collection of the Buddhist Pali Canon, transcribed in the Myanmar (Burmese) script. This dataset contains 462,504 paragraphs, covering the entire "Triple Basket" (Tipitaka) of Theravada Buddhism, including the original Mula (Canonical texts), Atthakatha (Commentaries), and Tika (Sub-commentaries). This project was initiated by DatarrX to provide a… See the full description on the dataset page: https://huggingface.co/datasets/DatarrX/tipitaka-dataset.

sourceHugging Facemitupdated 5mo agoView on Hugging Face
6likes34downloads
9 commits on main
106ae8c5mo ago

Update README.md

kalixlouiis
ccaa0938mo ago

Update README.md

kalixlouiis
2e65e478mo ago

Update README.md

kalixlouiis
96611df8mo ago

Update README.md

kalixlouiis
2f844688mo ago

Upload data.jsonl with huggingface_hub

kalixlouiis
45c10638mo ago

Delete datarrx_tipitaka_data.jsonl

kalixlouiis
6d2c5788mo ago

Update README.md

kalixlouiis
bab7d018mo ago

Upload datarrx_tipitaka_data.jsonl with huggingface_hub

kalixlouiis
77be8ba8mo ago

initial commit

kalixlouiis