CoolFace
Datasetpublic

prabhats0605/scanned-images-dataset-for-ocr-and-vlm-finetuning

Dataset Card for scanned_images_dataset This is a FiftyOne dataset containing 3,482 scanned document images across 10 diverse document categories. Designed for OCR training and Vision-Language Model (VLM) fine-tuning, this dataset features real-world scanned documents with varied layouts, scanning quality, and document types. Installation If you haven't already, install FiftyOne: pip install -U fiftyone Usage import fiftyone as fo from… See the full description on the dataset page: https://huggingface.co/datasets/prabhats0605/scanned-images-dataset-for-ocr-and-vlm-finetuning.

sourceHugging Facemitupdated 7mo agoView on Hugging Face
4likes203downloads
settings

This repository belongs to prabhats0605 on Hugging Face.

CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

namescanned-images-dataset-for-ocr-and-vlm-finetuning
visibilitypublic
licencemit
gatedno
ownerprabhats0605
Account settings
prabhats0605/scanned-images-dataset-for-ocr-and-vlm-finetuning · CoolFace