davanstrien/dots-ocr-britanica
Document OCR using dots.ocr This dataset contains OCR results from images in davanstrien/ency-test using DoTS.ocr, a compact 1.7B multilingual model. Processing Details Source Dataset: davanstrien/ency-test Model: rednote-hilab/dots.ocr Number of Samples: 512 Processing Time: 10.3 min Processing Date: 2025-10-09 07:52 UTC Configuration Image Column: image Output Column: markdown Dataset Split: train Batch Size: 512 Prompt Mode: layout-only Max… See the full description on the dataset page: https://huggingface.co/datasets/davanstrien/dots-ocr-britanica.
Upload README.md with huggingface_hub
Upload dataset
Upload README.md with huggingface_hub
Upload dataset
Upload README.md with huggingface_hub
Upload dataset
Upload README.md with huggingface_hub
Upload dataset
initial commit
