CoolFace
Datasetpublic

RavinduPabasara/tripitaka-en-chunks

Tripitaka English Chunks 28,554 paragraph-level chunks of the Pali Canon (Tipiṭaka/Tripitaka) in English — Bhante Sujato's translations from SuttaCentral, segmented and structured for retrieval-augmented generation (RAG), semantic search, and study tools. Each chunk keeps its canonical segment ID and a deep link back to SuttaCentral, so applications can always cite the exact passage. Coverage 4,166 distinct suttas across 13 collections: Collection Chunks… See the full description on the dataset page: https://huggingface.co/datasets/RavinduPabasara/tripitaka-en-chunks.

sourceHugging Facecc0-1.0updated 2mo agoView on Hugging Face
0likes12downloads
discussions and pull requests

Conversations for this repository live on Hugging Face.

CoolFace shows imported repositories read-only. Posting into someone else’s repository from here would need an authorised integration and the account holder’s consent, so the link goes to the source instead.

Open discussions on Hugging Face
RavinduPabasara/tripitaka-en-chunks · CoolFace