paddleocr_vl
PaddleOCR-VL_demotable_recognition_paddleocrvl16paddleocr-vl15-test
Document Processing using PaddleOCR-VL-1.5 (OCR mode)
This dataset contains OCR results from images in davanstrien/ufo-ColPali using PaddleOCR-VL-1.5, an ultra-compact 0.9B SOTA OCR model.
Processing Details
Source Dataset: davanstrien/ufo-ColPali
Model: PaddlePaddle/PaddleOCR-VL-1.5
Task Mode: ocr - General text extraction to markdown format
Number of Samples: 3
Processing Time: 2.3 min
Processing Date: 2026-01-30 10:03 UTC
Configuration
Image Column:… See the full description on the dataset page: https://huggingface.co/datasets/davanstrien/paddleocr-vl15-test.paddleocr-vl15-test-v3
Document Processing using PaddleOCR-VL-1.5 (OCR mode)
This dataset contains OCR results from images in davanstrien/ufo-ColPali using PaddleOCR-VL-1.5, an ultra-compact 0.9B SOTA OCR model.
Processing Details
Source Dataset: davanstrien/ufo-ColPali
Model: PaddlePaddle/PaddleOCR-VL-1.5
Task Mode: ocr - General text extraction to markdown format
Number of Samples: 10
Processing Time: 8.2 min
Processing Date: 2026-01-30 11:35 UTC
Configuration
Image Column:… See the full description on the dataset page: https://huggingface.co/datasets/davanstrien/paddleocr-vl15-test-v3.paddleocr-vl15-test-v4
Document Processing using PaddleOCR-VL-1.5 (OCR mode)
This dataset contains OCR results from images in davanstrien/ufo-ColPali using PaddleOCR-VL-1.5, an ultra-compact 0.9B SOTA OCR model.
Processing Details
Source Dataset: davanstrien/ufo-ColPali
Model: PaddlePaddle/PaddleOCR-VL-1.5
Task Mode: ocr - General text extraction to markdown format
Number of Samples: 2
Processing Time: 1.8 min
Processing Date: 2026-01-30 11:45 UTC
Configuration
Image Column:… See the full description on the dataset page: https://huggingface.co/datasets/davanstrien/paddleocr-vl15-test-v4.paddleocr-vl16-final-smoke
Document Processing using PaddleOCR-VL-1.6 (OCR mode)
This dataset contains OCR results from images in davanstrien/ufo-ColPali using PaddleOCR-VL-1.6, an ultra-compact 0.9B OCR model (96.33% SOTA on OmniDocBench v1.6).
Processing Details
Source Dataset: davanstrien/ufo-ColPali
Model: PaddlePaddle/PaddleOCR-VL-1.6
Task Mode: ocr - General text extraction to markdown format
Number of Samples: 5
Processing Time: 2.1 min
Processing Date: 2026-06-01 14:07 UTC… See the full description on the dataset page: https://huggingface.co/datasets/davanstrien/paddleocr-vl16-final-smoke.
