CoolFace
Modelpublic

meteorain/Qwen3-4B-Thinking-2507-llmc-awq-w4a16-g128-n256-s4096

sourceHugging Faceupdated 3mo agoView on Hugging Face
0likes13downloads
Model Card

Qwen3-4B-Thinking-2507-llmc-awq-w4a16-g128-n256-s4096

Base model: Qwen/Qwen3-4B-Thinking-2507

Quantized with llm-compressor.

  • —method: awq
  • —weight format: W4A16
  • —group size: 128
  • —calibration dataset: nvidia/Llama-Nemotron-Post-Training-Dataset
  • —calibration split: math
  • —calibration samples: 256
  • —max sequence length: 4096