CoolFace
Datasetpublic

ved1245/synthetic-manuscript-dataset

Synthetic Manuscript Dataset Synthetic historical manuscript folios generated using an automated Python pipeline. Scripts The dataset contains three script configurations: Devanagari Modi Sharada Each script contains 100 synthetic manuscript folios. Dataset Splits Split Samples per Script Train 85 Validation 10 Test 5 Total 100 Across all three scripts, the dataset contains: 300 manuscript images 300 corresponding Markdown… See the full description on the dataset page: https://huggingface.co/datasets/ved1245/synthetic-manuscript-dataset.

sourceHugging Faceupdated 15d agoView on Hugging Face
1likes778downloads
5 commits on main
ae3179a15d ago

Delete random_devanagari.png

ved1245
9b5065b15d ago

Upload folder using huggingface_hub (part 3)

ved1245
299d78c15d ago

Upload folder using huggingface_hub (part 2)

ved1245
1838fab15d ago

Upload folder using huggingface_hub

ved1245
31f590115d ago

initial commit

ved1245