hezarai/parsynth-ocr-200k
ParsynthOCR is a synthetic dataset for Persian OCR. This version is a preview of the original 4 million samples dataset (ParsynthOCR-4M). Usage š¤ Datasets from datasets import load_dataset dataset = load_dataset("hezarai/parsynth-ocr-200k") Hezar pip install hezar from hezar.data import Dataset dataset = Dataset.load("hezarai/parsynth-ocr-200k", split="train")
Delete annotations_test.csv
Delete annotations_train.csv
Delete images.zip
Delete parsynth-ocr-200k.py
Upload dataset
Update README.md
Update README.md
Hezar: Upload dataset_config.yaml
Hezar: Upload dataset_config.yaml
Create README.md
Create parsynth-ocr-200k.py
Upload 2 files
Rename parsynth-ocr-200k.zip to images.zip
Upload parsynth-ocr-200k.zip
initial commit
