sarayar/Qwen2.5-Coder-7B-Instruct-GGUF-Q3_K_M
1127
Qwen2.5-Coder-7B-Instruct GGUF (Q3KM)
Esta es una versión cuantizada en formato GGUF (Q3_K_M) del modelo original Qwen/Qwen2.5-Coder-7B-Instruct.
Optimizada especialmente para correr de forma ultra fluida en GPUs con espacio de VRAM ajustado (como las tarjetas de 4 GB de VRAM), manteniendo un equilibrio excelente en tareas de desarrollo de software y programación.
Uso directo en Ollama
Puedes descargar e interactuar con este modelo directamente usando Ollama ejecutando:
ollama run hf.co/sarayar/Qwen2.5-Coder-7B-Instruct-GGUF-Q3_K_M