CoolFace
Modelpublic

RichardErkhov/saqada_-_Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2-gguf

sourceHugging Faceupdated 2y agoView on Hugging Face
0likes718downloads
Model Card

Quantization made by Richard Erkhov.

Github

Discord

Request more models

Llama-3.2-3B-with-16bit-mergedloraadapters-MOV_v2 - GGUF

  • —Model creator: https://huggingface.co/saqada/
  • —Original model: https://huggingface.co/saqada/Llama-3.2-3B-with-16bit-mergedloraadapters-MOV_v2/
NameQuant methodSize
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q2_K.ggufQ2_K1.27GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.IQ3_XS.ggufIQ3_XS1.38GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.IQ3_S.ggufIQ3_S1.44GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q3_K_S.ggufQ3KS1.44GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.IQ3_M.ggufIQ3_M1.49GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q3_K.ggufQ3_K1.57GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q3_K_M.ggufQ3KM1.57GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q3_K_L.ggufQ3KL1.69GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.IQ4_XS.ggufIQ4_XS1.71GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q4_0.ggufQ4_01.79GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.IQ4_NL.ggufIQ4_NL1.79GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q4_K_S.ggufQ4KS1.8GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q4_K.ggufQ4_K1.88GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q4_K_M.ggufQ4KM1.88GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q4_1.ggufQ4_11.95GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q5_0.ggufQ5_02.11GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q5_K_S.ggufQ5KS2.11GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q5_K.ggufQ5_K2.16GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q5_K_M.ggufQ5KM2.16GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q5_1.ggufQ5_12.28GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q6_K.ggufQ6_K2.46GB
Llama-3.2-3B-with-16bit-merged_lora_adapters-MOV_v2.Q8_0.ggufQ8_03.19GB

Original model description: --- base_model: unsloth/Llama-3.2-3B language:

  • —en license: apache-2.0 tags:
  • —text-generation-inference
  • —transformers
  • —unsloth
  • —llama
  • —trl
  • —sft ---

Uploaded model

  • —Developed by: saqada
  • —License: apache-2.0
  • —Finetuned from model : unsloth/Llama-3.2-3B

This llama model was trained 2x faster with Unsloth and Huggingface's TRL library.

<img src="https://raw.githubusercontent.com/unslothai/unsloth/main/images/unsloth%20made%20with%20love.png" width="200"/>