CoolFace
Modelpublic

mamii76/Snowball-7B-Hybrid

sourceHugging Faceapache-2.0updated 3mo agoView on Hugging Face
1likes30downloads
Model Card

❄️ Snowball-7B-Hybrid (كرة الثلج)

نموذج هجين يجمع التفكير المنطقي والبرمجة عبر دمج TIES باستخدام mergekit.

⚠️ اللغة الأساسية: الإنجليزية. الأداء الأفضل في التفكير والبرمجة بالإنجليزية. دعم العربية محدود/تجريبي.

🧬 النماذج المدموجة

  • —🧠 التفكير: open-thoughts/OpenThinker2-7B
  • —💻 البرمجة: Qwen/Qwen2.5-Coder-7B-Instruct
  • —⚙️ الأساس: Qwen/Qwen2.5-7B

📦 الملفات (GGUF)

الملفالحجمالاستخدام
Q4KM~4.4GBمتوازن (موصى به)
Q8_0~7.6GBدقة أعلى

⚙️ إعدادات التوليد الموصى بها

للحصول على أنظف إجابة وتقليل الإسهاب في النهاية:

bash
llama-cli -m Snowball-7B-Hybrid-Q4_K_M.gguf -cnv \
  --temp 0.6 --top-p 0.9 --top-k 40 --repeat-penalty 1.1 -n 512

🚀 التشغيل (llama.cpp)

bash
llama-cli -m Snowball-7B-Hybrid-Q4_K_M.gguf -p "Write a Python function for prime numbers" -cnv

🛠️ وصفة الدمج

yaml
merge_method: ties
base_model: Qwen/Qwen2.5-7B
dtype: bfloat16
tokenizer_source: Qwen/Qwen2.5-Coder-7B-Instruct

صُنع بـ ❤️ — Snowball ❄️


❄️ Snowball-7B-Hybrid

A hybrid model combining logical reasoning and coding via a TIES merge with mergekit.

⚠️ Primary language: English. Best performance for reasoning and coding in English. Arabic support is limited/experimental.

🧬 Merged Models

  • —🧠 Reasoning: open-thoughts/OpenThinker2-7B
  • —💻 Coding: Qwen/Qwen2.5-Coder-7B-Instruct
  • —⚙️ Base: Qwen/Qwen2.5-7B

📦 Files (GGUF)

FileSizeUse case
Q4KM~4.4GBBalanced (recommended)
Q8_0~7.6GBHigher precision

⚙️ Recommended Generation Settings

For the cleanest output and to reduce trailing verbosity:

bash
llama-cli -m Snowball-7B-Hybrid-Q4_K_M.gguf -cnv \
  --temp 0.6 --top-p 0.9 --top-k 40 --repeat-penalty 1.1 -n 512

🚀 Usage (llama.cpp)

bash
llama-cli -m Snowball-7B-Hybrid-Q4_K_M.gguf -p "Write a Python function for prime numbers" -cnv

🛠️ Merge Recipe

yaml
merge_method: ties
base_model: Qwen/Qwen2.5-7B
dtype: bfloat16
tokenizer_source: Qwen/Qwen2.5-Coder-7B-Instruct

Made with ❤️ — Snowball ❄️