CoolFace
20 results

glm_ocr

omarelsherif010 /glm-ocr-bnk-finetuning GLM-OCR Fine-Tuning Pipeline Fine-tuning GLM-OCR 0.9B (CogViT encoder + GLM-0.5B decoder) for Korean financial document table recognition using LoRA via LLaMA-Factory. Performance Targets Metric Target TEDS (2-level nested) >= 90% TEDS (3-level nested) >= 85% Korean CER <= 1% Latency <= 0.5s/page Directory Structure glm_ocr_finetuning/ ├── config/ # Training/eval YAML configs │ ├── training_config.yaml #… See the full description on the dataset page: https://huggingface.co/datasets/omarelsherif010/glm-ocr-bnk-finetuning.0 likes668 downloads7mo agoHugging Facep4ulbr4dl3y /glm-ocr-ru-dataset GLM-OCR Russian Dataset (Interfax) This dataset was generated programmatically for fine-tuning Vision-Language models, specifically GLM-OCR or Qwen-VL / Qwen2-VL, on Russian document OCR. Dataset Details Source: News texts from the Russian news agency "Interfax". Size: 4,998 samples (multi-paragraph image-text pairs). Format: ShareGPT VLM format (compatible with LLaMA-Factory out-of-the-box). Image format: WebP (quality 85) for minimal disk space footprint (~150… See the full description on the dataset page: https://huggingface.co/datasets/p4ulbr4dl3y/glm-ocr-ru-dataset.image1K<n<10K0 likes364 downloads3mo agoHugging Facedavanstrien /bpl-card-catalog-glm-ocr Document OCR using GLM-OCR This dataset contains OCR results from images in davanstrien/bpl-card-catalog-with-ocr using GLM-OCR, a compact 0.9B OCR model achieving SOTA performance. Processing Details Source Dataset: davanstrien/bpl-card-catalog-with-ocr Model: zai-org/GLM-OCR Task: text recognition Number of Samples: 453,006 Processing Time: 1315.3 min Processing Date: 2026-02-27 11:43 UTC Configuration Image Column: image Output Column: markdown… See the full description on the dataset page: https://huggingface.co/datasets/davanstrien/bpl-card-catalog-glm-ocr.image100K<n<1M0 likes97 downloads7mo agoHugging Facedavanstrien /enc-brit-glm-ocr-v2-full Document OCR using GLM-OCR This dataset contains OCR results from images in davanstrien/encyclopaedia-britannica-1771 using GLM-OCR, a compact 0.9B OCR model achieving SOTA performance. Processing Details Source Dataset: davanstrien/encyclopaedia-britannica-1771 Model: zai-org/GLM-OCR Task: text recognition Number of Samples: 2,724 Processing Time: 376.7 min Processing Date: 2026-02-18 20:29 UTC Configuration Image Column: image Output Column: markdown… See the full description on the dataset page: https://huggingface.co/datasets/davanstrien/enc-brit-glm-ocr-v2-full.image1K<n<10K4 likes60 downloads7mo agoHugging Faceandesco /risk-financing-4th-glm-ocrimagen<1K0 likes29 downloads7mo agoHugging Facemehdigououiad /permis-ocr-glm Document OCR using GLM-OCR This dataset contains OCR results from images in mehdigououiad/permis-ocr-bench using GLM-OCR, a compact 0.9B OCR model achieving SOTA performance. Processing Details Source Dataset: mehdigououiad/permis-ocr-bench Model: zai-org/GLM-OCR Task: text recognition Number of Samples: 2 Processing Time: 1.3 min Processing Date: 2026-08-11 13:48 UTC Configuration Image Column: image Output Column: markdown Dataset Split: train… See the full description on the dataset page: https://huggingface.co/datasets/mehdigououiad/permis-ocr-glm.imagen<1K0 likes27 downloads1mo agoHugging Face