KevHamm07/qwen2.5-coder-7b-hermes-reviewer-gguf-v0-1
036
qwen2.5-coder-7b-hermes-reviewer-gguf-v0-1
GGUF conversion of KevHamm07/qwen2.5-coder-7b-hermes-reviewer-lora-v0-1, a LoRA adapter merged into Qwen/Qwen2.5-Coder-7B-Instruct.
Files
qwen2.5-coder-7b-hermes-reviewer-lora-v0-1-q4_k_m.gguf— Q4KM — 4.36 GiBqwen2.5-coder-7b-hermes-reviewer-lora-v0-1-q5_k_m.gguf— Q5KM — 5.07 GiB
Ollama
hf download KevHamm07/qwen2.5-coder-7b-hermes-reviewer-gguf-v0-1 qwen2.5-coder-7b-hermes-reviewer-lora-v0-1-q4_k_m.gguf --local-dir ./model-gguf
cat > ./model-gguf/Modelfile <<'EOF'
FROM ./qwen2.5-coder-7b-hermes-reviewer-lora-v0-1-q4_k_m.gguf
PARAMETER temperature 0.2
PARAMETER num_ctx 4096
PARAMETER stop <|im_end|>
EOF
ollama create my-model:latest -f ./model-gguf/Modelfile
ollama run my-model:latest