BDRC/tibetan-script-classification-benchmark
Tibetan Script Classification Benchmark Holdout benchmark for 6-class Tibetan script classification. Test split only — not used during training. All images are BDRC manuscript page scans, balanced by subclass. Class Images Subclasses Danyig 60 DraDring: 25, DraRing: 9, Drathung: 17, Gongshabma: 3, Tsegdrig: 6 Druma 60 Dhumri: 22, DruDring: 20, DruRing: 10, Druchen: 2, Druthung: 6 Gyuyig 60 Khyuyig: 31, Tsumachug: 15, Yigchung: 14 Pedri 60 Peri: 44, Petsuk: 16… See the full description on the dataset page: https://huggingface.co/datasets/BDRC/tibetan-script-classification-benchmark.
Tibetan Script Classification Benchmark
Holdout benchmark for 6-class Tibetan script classification. Test split only — not used during training. All images are BDRC manuscript page scans, balanced by subclass.
Total: 480 images across 8 classes.
Parquet schema
Load in Python
from datasets import load_dataset
ds = load_dataset("BDRC/tibetan-script-classification-benchmark", split="test")
print(len(ds)) # 480
row = ds[0]
# row["id"], row["image_bytes"], row["script"]Evaluate a model
from experiments.benchmark_eval.eval import run_benchmark
run_benchmark(model, repo_id="BDRC/tibetan-script-classification-benchmark")Citation
@misc{bdrcscriptbenchmark,
title = {Tibetan Script Classification Benchmark},
author = {Buddhist Digital Resource Center and OpenPecha},
year = {2026},
url = {https://huggingface.co/datasets/BDRC/tibetan-script-classification-benchmark},
note = {Images from BDRC. MIT.}
}Acknowledgements
Images from the [Buddhist Digital Resource Center](https://www.bdrc.io) (BDRC). Developed by Dharmaduta / OpenPecha.
