glm_ocr
Datasets
All datasets matching “glm_ocr”glm-ocr-bnk-finetuning
GLM-OCR Fine-Tuning Pipeline
Fine-tuning GLM-OCR 0.9B (CogViT encoder + GLM-0.5B decoder) for Korean financial document table recognition using LoRA via LLaMA-Factory.
Performance Targets
Metric
Target
TEDS (2-level nested)
>= 90%
TEDS (3-level nested)
>= 85%
Korean CER
<= 1%
Latency
<= 0.5s/page
Directory Structure
glm_ocr_finetuning/
├── config/ # Training/eval YAML configs
│ ├── training_config.yaml #… See the full description on the dataset page: https://huggingface.co/datasets/omarelsherif010/glm-ocr-bnk-finetuning.glm-ocr-ru-dataset
GLM-OCR Russian Dataset (Interfax)
This dataset was generated programmatically for fine-tuning Vision-Language models, specifically GLM-OCR or Qwen-VL / Qwen2-VL, on Russian document OCR.
Dataset Details
Source: News texts from the Russian news agency "Interfax".
Size: 4,998 samples (multi-paragraph image-text pairs).
Format: ShareGPT VLM format (compatible with LLaMA-Factory out-of-the-box).
Image format: WebP (quality 85) for minimal disk space footprint (~150… See the full description on the dataset page: https://huggingface.co/datasets/p4ulbr4dl3y/glm-ocr-ru-dataset.bpl-card-catalog-glm-ocr
Document OCR using GLM-OCR
This dataset contains OCR results from images in davanstrien/bpl-card-catalog-with-ocr using GLM-OCR, a compact 0.9B OCR model achieving SOTA performance.
Processing Details
Source Dataset: davanstrien/bpl-card-catalog-with-ocr
Model: zai-org/GLM-OCR
Task: text recognition
Number of Samples: 453,006
Processing Time: 1315.3 min
Processing Date: 2026-02-27 11:43 UTC
Configuration
Image Column: image
Output Column: markdown… See the full description on the dataset page: https://huggingface.co/datasets/davanstrien/bpl-card-catalog-glm-ocr.enc-brit-glm-ocr-v2-full
Document OCR using GLM-OCR
This dataset contains OCR results from images in davanstrien/encyclopaedia-britannica-1771 using GLM-OCR, a compact 0.9B OCR model achieving SOTA performance.
Processing Details
Source Dataset: davanstrien/encyclopaedia-britannica-1771
Model: zai-org/GLM-OCR
Task: text recognition
Number of Samples: 2,724
Processing Time: 376.7 min
Processing Date: 2026-02-18 20:29 UTC
Configuration
Image Column: image
Output Column: markdown… See the full description on the dataset page: https://huggingface.co/datasets/davanstrien/enc-brit-glm-ocr-v2-full.risk-financing-4th-glm-ocrpermis-ocr-glm
Document OCR using GLM-OCR
This dataset contains OCR results from images in mehdigououiad/permis-ocr-bench using GLM-OCR, a compact 0.9B OCR model achieving SOTA performance.
Processing Details
Source Dataset: mehdigououiad/permis-ocr-bench
Model: zai-org/GLM-OCR
Task: text recognition
Number of Samples: 2
Processing Time: 1.3 min
Processing Date: 2026-08-11 13:48 UTC
Configuration
Image Column: image
Output Column: markdown
Dataset Split: train… See the full description on the dataset page: https://huggingface.co/datasets/mehdigououiad/permis-ocr-glm.
