sigmanih/Qwen-Qwen2.5-Coder-14B-Instruct-GGUF-Q6_K
<div align="center">
⚡ Qwen-Qwen2.5-Coder-14B-Instruct-GGUF-Q6_K
High-Performance Model Published via [Σ-SIGMA Studio](https://github.com/Sigmanih/SigmaStudio)
  [](https://github.com/Sigmanih/SigmaStudio) [](https://opensource.org/licenses/Apache-2.0)
</div>
❤️ Support & Community: If you find this model helpful, please give this repository a Like on Hugging Face and a ⭐ Star on our [SigmaStudio GitHub](https://github.com/Sigmanih/SigmaStudio)!
🌐 English Overview
Qwen-Qwen2.5-Coder-14B-Instruct-GGUF-Q6_K is a production-ready model optimized and published using the Model Hub module of [Sigma Studio](https://github.com/Sigmanih/SigmaStudio).
⚙️ Technical Specifications & Architecture
🏆 Official Benchmark Performance
Evaluated directly on GPU via Sigma Studio Training Lab (Deterministic seed 42, Temp 0.0):
🧠 Reasoning Mode Comparison: No-Thinking vs Thinking
Side-by-side performance comparison between direct zero-overhead answer (No-Thinking) and Chain-of-Thought step-by-step reasoning (Deep Thinking CoT):
⚡ No-Thinking (Direct Response) : [██████████████░░░░░░] 71.9% (41/57 passed)
🧠 Deep Thinking (CoT Reasoning) : [█████████████░░░░░░░] 65.1% (28/43 passed)
📈 CoT Performance Delta : -6.8%%%{init: {'theme': 'dark'}}%%
xychart-beta
title "Accuracy (%): No-Thinking vs Deep Thinking"
x-axis ["⚡ No-Thinking (Direct)", "🧠 Deep Thinking (CoT)"]
y-axis "Accuracy (%)" 0 --> 100
bar [71.9, 65.1]📋 Per-Dataset Evaluation Breakdown
Protocol: codeexecution, continuationlogprob, cotgeneration, letterlogprob · temp 0.0 · seed 42
🛠️ Tool Calling & Agentic Protocol Benchmark (Sigma Studio Sandbox Jail)
Empirical multi-turn agent reliability evaluation (zero quizzes, fully grounded file-system actions inside isolated Sandbox Jail):
📋 Per-Scenario Protocol Breakdown
🔍 Certified Autonomous Capabilities:
- ✅ Tool Grounding: Exclusively uses registered tools and valid schemas (zero hallucinated functions).
- ✅ Zero Placeholder Echo: Emits concrete code and values rather than copy-pasting prompt templates.
- ✅ Inspect-Before-Edit: Systematically reads files and verifies target lines before patching.
- ✅ Evidence-Based Exit: Emits concrete test commands and validation checks before task exit.
- ✅ Sandbox Containment: Strictly adheres to isolated sandbox jail boundaries.
⚡ Measured Speed on the Publishing Machine
Measured on NVIDIA GeForce RTX 5070 Ti • 15.9 GB VRAM during the evaluation run.
Speeds on other hardware were not measured and are not guessed here. A single-stream figure from one machine cannot be scaled into a prediction for another: it depends on memory bandwidth, quantization, context length and driver, and the error is large enough to be misleading.
🚀 Quick Start Guide
1. Running with Sigma Studio (Recommended)
Launch Sigma Studio to enjoy full 1-click GPU hardware acceleration, live monitoring, and visual chat:
# Clone and run Sigma Studio
git clone https://github.com/Sigmanih/SigmaStudio.git
cd SigmaStudio
.\sigma_studio.bat2. Running with llama.cpp
llama-cli -hf sigmanih/Qwen-Qwen2.5-Coder-14B-Instruct-GGUF-Q6_K -p "Hello! How can I help you today?" -ngl 99🇮🇹 Documentazione in Italiano
Qwen-Qwen2.5-Coder-14B-Instruct-GGUF-Q6_K è un modello ottimizzato pronto per l'inferenza e l'integrazione locale, pubblicato attraverso [Σ-SIGMA Studio](https://github.com/Sigmanih/SigmaStudio).
📋 Specifiche e Configurazione
- Architettura Base:
CausalLM(14B parametri) - Formato Pesi:
GGUF(Q6_K) - Spazio su Disco:
11.29 GB - RAM / VRAM in Esecuzione:
~12.4 GB VRAM(offload GPU completo) |~12.2 GB RAM(inferenza CPU/ibrida) - Requisiti Hardware Consigliati: GPU con 12-16 GB VRAM (es. RTX 3060/4070 o 32 GB RAM)
- Finestra di Contesto:
32,768 token - Profilo d'Uso Consigliato: Coding ad alta velocità, assistenti quotidiani, loop di agenti autonomi e ragionamento.
📊 Risultati Benchmark Ufficiali
- Suite di Valutazione:
Tutti i Benchmark Ufficiali - Punteggio Ufficiale: `69.0%` (69/100 quesiti superati)
🧠 Confronto Modalità di Risposta: No-Thinking vs Thinking
Confronto visuale tra risposta istantanea diretta (No-Thinking) e ragionamento guidato multi-step (Deep Thinking CoT):
⚡ No-Thinking (Risposta Diretta) : [██████████████░░░░░░] 71.9% (41/57 superati)
🧠 Deep Thinking (CoT Reasoning) : [█████████████░░░░░░░] 65.1% (28/43 superati)
📈 Delta Prestazionale CoT : -6.8%%%{init: {'theme': 'dark'}}%%
xychart-beta
title "Accuratezza (%): No-Thinking vs Deep Thinking"
x-axis ["⚡ No-Thinking (Diretto)", "🧠 Deep Thinking (CoT)"]
y-axis "Accuratezza (%)" 0 --> 100
bar [71.9, 65.1]📋 Dettaglio Punteggi per Singolo Dataset
Protocollo: codeexecution, continuationlogprob, cotgeneration, letterlogprob · temp 0.0 · seed 42
- Data Test:
2026-09-07su motore deterministico SigmaEngine
🛠️ Benchmark Aderenza Tool & Capacità Agente (Sigma Studio Sandbox Jail)
Valutazione empirica dell'affidabilità nei compiti di agente autonomo (nessun quiz teorico, solo esecuzioni e verifiche su filesystem isolato):
📋 Dettaglio Prove per Scenario Operativo
🔍 Comportamenti Rigorosamente Certificati:
- ✅ Tool Grounding: Utilizzo esclusivo di tool formalmente registrati (zero allucinazioni di comandi).
- ✅ No Segnaposto: Produzione di codice e parametri concreti senza eco di placeholder d'esempio.
- ✅ Ispezione Previa: Lettura e verifica dei file prima di eseguire modifiche chirurgiche.
- ✅ Verifica di Chiusura: Certificazione delle prove prima di dichiarare terminato il lavoro.
- ✅ Confinamento Jail: Isolamento totale senza contaminazione del kernel o del sistema host.
⏱️ Throughput Hardware e Fasce Consigliate
- Velocità Verificata in Locale: `51.5 tok/s` su
NVIDIA GeForce RTX 5070 Ti. - Throughput complessivo durante la valutazione:
51.5 tok/s— piu' richieste in volo insieme, non la velocita' di una risposta singola. - Le velocita' su altro hardware non sono state misurate e non vengono indovinate: dipendono da banda di memoria, quantizzazione, lunghezza del contesto e driver.
⭐ Supporta il Progetto Open Source
Se questo modello ti è utile o vuoi esplorare l'ecosistema completo:
- 🌟 Metti una Stella al repository GitHub: [Sigmanih/SigmaStudio](https://github.com/Sigmanih/SigmaStudio)
- ❤️ Lascia un Like a questa scheda su Hugging Face
Creato e distribuito con il Model Hub di Σ-SIGMA Studio (13/09/2026 17:45)
