CoolFace
Modelpublic

meteorain/Qwen3-4B-Thinking-2507-llmc-awq-calib-ultrachat-200k-train-sft-w4a16-g128-n256-s1024

sourceHugging Faceupdated 3mo agoView on Hugging Face
0likes6downloads
Model Card

Qwen3-4B-Thinking-2507-llmc-awq-calib-ultrachat-200k-train-sft-w4a16-g128-n256-s1024

Base model: Qwen/Qwen3-4B-Thinking-2507

Quantized with llm-compressor.

  • —method: awq
  • —weight format: W4A16
  • —group size: 128
  • —calibration dataset: HuggingFaceH4/ultrachat_200k
  • —calibration dataset config: ``
  • —calibration split: train_sft
  • —calibration samples: 256
  • —max sequence length: 1024