CoolFace
Modelpublic

switzerchees/LightOnOCR-2-1B-NVFP4

sourceHugging Faceapache-2.0updated 7mo agoView on Hugging Face
0likes345downloads
Model Card

LightOnOCR-2-1B-NVFP4

This is a NVFP4 variant of lightonai/LightOnOCR-2-1B, quantized with NVIDIA Model Optimizer PTQ for vLLM (modelopt_fp4) compatibility.

Upstream Model

Quantization Notes

  • —Quantization format: NVFP4
  • —Runtime target: vLLM with quantization="modelopt_fp4"
  • —Tooling: NVIDIA Model Optimizer
  • —Selective policy used for current vLLM compatibility:
  • —Quantized: language model and vision projection linear layers
  • —Kept BF16: vision encoder and vision patch merger

Usage (vLLM)

bash
vllm serve switzerchees/LightOnOCR-2-1B-NVFP4 \
  --quantization modelopt_fp4 \
  --limit-mm-per-prompt '{"image": 1}' \
  --mm-processor-cache-gb 0 \
  --no-enable-prefix-caching

License

This derivative keeps the same license as the upstream model: Apache-2.0. See the original model card for upstream attribution and details: lightonai/LightOnOCR-2-1B