CoolFace
Modelpublic

Alcoft/dnotitia_Smoothie-Qwen3-1.7B-GGUF

sourceHugging Faceapache-2.0updated 1y agoView on Hugging Face
1likes1.4kdownloads
Model Card
QuantSizeDescription
Q2_K_XXS595.71 MBNot recommended for most people. Extremelly low quality.
Q2_K_XS595.71 MBNot recommended for most people. Very low quality.
Q2_K595.71 MBNot recommended for most people. Very low quality.
Q2_K_L813.63 MBNot recommended for most people. Uses Q80 for output and embedding, and Q2K for everything else. Very low quality.
Q2_K_XL1.07 GBNot recommended for most people. Uses F16 for output and embedding, and Q2_K for everything else. Very low quality.
Q3_K_XXS711.16 MBNot recommended for most people. Prefer any bigger Q3_K quantization. Very low quality.
Q3_K_XS711.16 MBNot recommended for most people. Prefer any bigger Q3_K quantization. Very low quality.
Q3_K_S711.16 MBNot recommended for most people. Prefer any bigger Q3_K quantization. Low quality.
Q3_K_M780.1 MBNot recommended for most people. Low quality.
Q3_K_L841.1 MBNot recommended for most people. Low quality.
Q3_K_XL1.0 GBNot recommended for most people. Uses Q80 for output and embedding, and Q3K_L for everything else. Low quality.
Q3_K_XXL1.28 GBNot recommended for most people. Uses F16 for output and embedding, and Q3KL for everything else. Low quality.
Q4_K_XS934.57 MBLower quality than Q4KS.
Q4_K_S934.57 MBRecommended. Slightly low quality.
Q4_K_M979.6 MBRecommended. Decent quality for most use cases.
Q4_K_L1.1 GBRecommended. Uses Q80 for output and embedding, and Q4K_M for everything else. Decent quality.
Q4_K_XL1.37 GBRecommended. Uses F16 for output and embedding, and Q4KM for everything else. Decent quality.
Q5_K_XXS1.11 GBLower quality than Q5KS.
Q5_K_XS1.11 GBLower quality than Q5KS.
Q5_K_S1.11 GBRecommended. High quality.
Q5_K_M1.13 GBRecommended. High quality.
Q5_K_L1.24 GBRecommended. Uses Q80 for output and embedding, and Q5K_M for everything else. High quality.
Q5_K_XL1.51 GBRecommended. Uses F16 for output and embedding, and Q5KM for everything else. High quality.
Q6_K_S1.32 GBLower quality than Q6_K.
Q6_K1.32 GBRecommended. Very high quality.
Q6_K_L1.39 GBRecommended. Uses Q80 for output and embedding, and Q6K for everything else. Very high quality.
Q6_K_XL1.66 GBRecommended. Uses F16 for output and embedding, and Q6_K for everything else. Very high quality.
Q8_K_XS1.71 GBLower quality than Q8_0.
Q8_K_S1.71 GBLower quality than Q8_0.
Q8_01.71 GBRecommended. Quality almost like F16.
Q8_K_XL1.98 GBRecommended. Uses F16 for output and embedding, and Q8_0 for everything else. Quality almost like F16.
F163.21 GBNot recommended. Overkill. Prefer Q8_0.
ORIGINAL (BF16)3.21 GBNot recommended. Overkill. Prefer Q8_0.

Quantized using TAO71-AI AutoQuantizer. You can check out the original model card here.