CoolFace
Datasetpublic

davanstrien/dots-ocr-britanica

Document OCR using dots.ocr This dataset contains OCR results from images in davanstrien/ency-test using DoTS.ocr, a compact 1.7B multilingual model. Processing Details Source Dataset: davanstrien/ency-test Model: rednote-hilab/dots.ocr Number of Samples: 512 Processing Time: 10.3 min Processing Date: 2025-10-09 07:52 UTC Configuration Image Column: image Output Column: markdown Dataset Split: train Batch Size: 512 Prompt Mode: layout-only Max… See the full description on the dataset page: https://huggingface.co/datasets/davanstrien/dots-ocr-britanica.

sourceHugging Faceupdated 1y agoView on Hugging Face
0likes34downloads
9 commits on main
9030d191y ago

Upload README.md with huggingface_hub

davanstrien
d2ace971y ago

Upload dataset

davanstrien
95428361y ago

Upload README.md with huggingface_hub

davanstrien
e051c8c1y ago

Upload dataset

davanstrien
ad73fe81y ago

Upload README.md with huggingface_hub

davanstrien
3b5de531y ago

Upload dataset

davanstrien
09abb491y ago

Upload README.md with huggingface_hub

davanstrien
29b14681y ago

Upload dataset

davanstrien
76dbd0e1y ago

initial commit

davanstrien