CoolFace
Modelpublic

prithivMLmods/Q3.5-4B-OpusGLM-MAX-0731-ablated-GGUF

sourceHugging Faceapache-2.0updated 2mo agoView on Hugging Face
1likes615downloads
Model Card

Q3.5-4B-OpusGLM-MAX-0731-ablated-GGUF

Q3.5-4B-OpusGLM-MAX-0731-ablated is a reasoning-capable 4B-parameter language model built on top of Qwen/Qwen3.5-4B. The model was trained through a multi-stage training pipeline using General Purpose GLM and Opus reasoning traces, along with additional high-quality reasoning traces, to improve long-form reasoning, mathematical problem solving, scientific analysis, instruction-following capabilities, and general analytical performance.
[!IMPORTANT] This model is an experimental release and may generate unexpected behaviors or reasoning artifacts in certain scenarios.

Model Files

File NameQuant TypeFile SizeFile Link
Q3.5-4B-OpusGLM-MAX-0731-ablated.BF16.ggufBF168.42 GBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.F16.ggufF168.42 GBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.Q3KL.ggufQ3KL2.42 GBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.Q3KM.ggufQ3KM2.26 GBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.Q3KS.ggufQ3KS2.07 GBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.Q4KM.ggufQ4KM2.71 GBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.Q4KS.ggufQ4KS2.56 GBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.Q5KM.ggufQ5KM3.07 GBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.Q5KS.ggufQ5KS2.99 GBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.Q6_K.ggufQ6_K3.46 GBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.Q8_0.ggufQ8_04.48 GBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.mmproj-bf16.ggufmmproj-bf16676 MBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.mmproj-f16.ggufmmproj-f16676 MBDownload
Q3.5-4B-OpusGLM-MAX-0731-ablated.mmproj-q8_0.ggufmmproj-q8_0367 MBDownload

llama.cpp

LLM inference in C/C++ — https://github.com/ggml-org/llama.cpp