CoolFace
Modelpublic

glogwa68/granite-4.0-h-1b-DISTILL-glm-4.7-GGUF

sourceHugging Faceapache-2.0updated 9mo agoView on Hugging Face
3likes447downloads
Model Card

granite-4.0-h-1b-DISTILL-glm-4.7-GGUF

GGUF quantized versions of granite-4.0-h-1b-DISTILL-glm-4.7

Available Formats

FilenameSizeQuant TypeDescription
granite-4.0-h-1b-DISTILL-glm-4.7-f16.gguf2.73 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-F16
granite-4.0-h-1b-DISTILL-glm-4.7-q2_k.gguf0.55 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q2_K
granite-4.0-h-1b-DISTILL-glm-4.7-q3_k_l.gguf0.71 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q3KL
granite-4.0-h-1b-DISTILL-glm-4.7-q3_k_m.gguf0.68 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q3KM
granite-4.0-h-1b-DISTILL-glm-4.7-q3_k_s.gguf0.65 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q3KS
granite-4.0-h-1b-DISTILL-glm-4.7-q4_0.gguf0.81 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q4_0
granite-4.0-h-1b-DISTILL-glm-4.7-q4_1.gguf0.88 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q4_1
granite-4.0-h-1b-DISTILL-glm-4.7-q4_k_m.gguf0.84 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q4KM
granite-4.0-h-1b-DISTILL-glm-4.7-q4_k_s.gguf0.81 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q4KS
granite-4.0-h-1b-DISTILL-glm-4.7-q5_0.gguf0.96 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q5_0
granite-4.0-h-1b-DISTILL-glm-4.7-q5_1.gguf1.04 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q5_1
granite-4.0-h-1b-DISTILL-glm-4.7-q5_k_m.gguf0.98 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q5KM
granite-4.0-h-1b-DISTILL-glm-4.7-q5_k_s.gguf0.96 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q5KS
granite-4.0-h-1b-DISTILL-glm-4.7-q6_k.gguf1.12 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q6_K
granite-4.0-h-1b-DISTILL-glm-4.7-q8_0.gguf1.45 GBGRANITE-4.0-H-1B-DISTILL-GLM-4.7-Q8_0

Quick Start

Ollama

bash
# Use Q4_K_M (recommended)
ollama run hf.co/glogwa68/granite-4.0-h-1b-DISTILL-glm-4.7-GGUF:Q4_K_M

# Or other quantizations
ollama run hf.co/glogwa68/granite-4.0-h-1b-DISTILL-glm-4.7-GGUF:Q8_0
ollama run hf.co/glogwa68/granite-4.0-h-1b-DISTILL-glm-4.7-GGUF:Q2_K

llama.cpp

bash
# Download and run
llama-cli --hf-repo glogwa68/granite-4.0-h-1b-DISTILL-glm-4.7-GGUF --hf-file granite-4.0-h-1b-distill-glm-4.7-q4_k_m.gguf -p "Hello, how are you?"

# With server
llama-server --hf-repo glogwa68/granite-4.0-h-1b-DISTILL-glm-4.7-GGUF --hf-file granite-4.0-h-1b-distill-glm-4.7-q4_k_m.gguf -c 2048

LM Studio / GPT4All

Download the .gguf file of your choice and load it in your application.

Quantization Details

TypeBitsUse Case
Q2_K2Extreme compression, low quality
Q3KM3Very compressed
Q4KM4Recommended - Best size/quality
Q5KM5High quality
Q6_K6Very high quality
Q8_08Near lossless
F1616Original precision

Original Model

This is the quantized version of granite-4.0-h-1b-DISTILL-glm-4.7

  • —Base Model: ibm-granite/granite-4.0-h-1b
  • —Fine-tuning Dataset: TeichAI/glm-4.7-2000x
  • —Training Loss: 0.6364