CoolFace
Datasetpublic

hezarai/parsynth-ocr-200k

ParsynthOCR is a synthetic dataset for Persian OCR. This version is a preview of the original 4 million samples dataset (ParsynthOCR-4M). Usage šŸ¤— Datasets from datasets import load_dataset dataset = load_dataset("hezarai/parsynth-ocr-200k") Hezar pip install hezar from hezar.data import Dataset dataset = Dataset.load("hezarai/parsynth-ocr-200k", split="train")

sourceHugging Faceupdated 2y agoView on Hugging Face
24likes842downloads
15 commits on main
e55cca62y ago

Delete annotations_test.csv

arxyzan
26658012y ago

Delete annotations_train.csv

arxyzan
996cb622y ago

Delete images.zip

arxyzan
15003652y ago

Delete parsynth-ocr-200k.py

arxyzan
58988782y ago

Upload dataset

arxyzan
deef7ae3y ago

Update README.md

arxyzan
f0106ed3y ago

Update README.md

arxyzan
b4c53633y ago

Hezar: Upload dataset_config.yaml

arxyzan
3cb89e93y ago

Hezar: Upload dataset_config.yaml

arxyzan
bce9e673y ago

Create README.md

arxyzan
454e9623y ago

Create parsynth-ocr-200k.py

arxyzan
546483a3y ago

Upload 2 files

arxyzan
5740b633y ago

Rename parsynth-ocr-200k.zip to images.zip

arxyzan
e5f158c3y ago

Upload parsynth-ocr-200k.zip

arxyzan
b1e5fe23y ago

initial commit

arxyzan