CoolFace
Datasetpublic

m-biriuchinskii/ICDAR2017-filtered-1800-1900

This dataset is a filtered version of the ICDAR2017 Competition on Handwritten Text Recognition, focusing on monograph texts written between 1800 and 1900. It consists of a total of 957 documents, divided into training, validation, and testing sets, and is designed for post-correction of OCR (Optical Character Recognition) text. Total Documents: 957 Training Set: 765 Validation Set: 95 Test Set: 97 Purpose The dataset aims to improve the accuracy of digitized texts by… See the full description on the dataset page: https://huggingface.co/datasets/m-biriuchinskii/ICDAR2017-filtered-1800-1900.

sourceHugging Faceupdated 2y agoView on Hugging Face
1likes7downloads
14 commits on main
36380302y ago

Upload dataset

m-biriuchinskii
8a9a5b52y ago

Delete data

m-biriuchinskii
b79fdd62y ago

Upload dataset

m-biriuchinskii
33908a82y ago

Delete data

m-biriuchinskii
1e5b0af2y ago

Upload dataset

m-biriuchinskii
5e6eae52y ago

Delete data

m-biriuchinskii
5a303e32y ago

Upload dataset

m-biriuchinskii
1ea892a2y ago

Delete data

m-biriuchinskii
1e6e3d82y ago

Upload dataset

m-biriuchinskii
6e706a72y ago

Delete data

m-biriuchinskii
b6576ff2y ago

Update README.md

m-biriuchinskii
77b200a2y ago

Update README.md

m-biriuchinskii
1d8bc3f2y ago

Upload dataset

m-biriuchinskii
cb7ac432y ago

initial commit

m-biriuchinskii