CoolFace
Datasetpublic

HumynLabs/Russian_Documents_Dataset_PDF

Russian Documents Dataset (PDF) This dataset contains a curated collection of Russian-language documents in PDF format. The corpus includes books, academic papers, government publications, articles, and educational materials written in Russian. It is designed to support AI research in OCR, document understanding, and multilingual text recognition. Contact For queries or collaborations related to this dataset, contact: anoushka@kgen.io… See the full description on the dataset page: https://huggingface.co/datasets/HumynLabs/Russian_Documents_Dataset_PDF.

sourceHugging Facecc-by-4.0updated 11mo agoView on Hugging Face
1likes534downloads
settings

This repository belongs to HumynLabs on Hugging Face.

CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

nameRussian_Documents_Dataset_PDF
visibilitypublic
licencecc-by-4.0
gatedno
ownerHumynLabs
Account settings
HumynLabs/Russian_Documents_Dataset_PDF · CoolFace