CoolFace
Apppublic

mikelalda/Qwen3.8-27B_euskara

sourceHugging Faceupdated 1mo agoView on Hugging Face
0likes
App README

Qwen Euskara (ZeroGPU)

Chat con el modelo mikelalda/qwen3.8-27b_euskara (safetensors, vía transformers) corriendo sobre ZeroGPU — la GPU compartida y gratuita de Hugging Face Spaces (H200, asignada dinámicamente solo durante cada generación).

Paso obligatorio tras crear el Space

El SDK Gradio por sí solo no activa ZeroGPU. Después de subir estos archivos:

  1. 1.Ve a Settings del Space.
  2. 2.En Hardware, elige ZeroGPU.
  3. 3.Guarda — el Space se reconstruye con acceso a ZeroGPU.

Sin este paso, import spaces seguirá funcionando pero las llamadas @spaces.GPU no tendrán GPU real que asignar y fallarán o irán a CPU.

Variables de entorno (opcionales)

VariablePor defectoDescripción
MODEL_IDmikelalda/qwen3.8-27b_euskaraRepo de HF (safetensors)
MAX_NEW_TOKENS1024Tokens máximos por respuesta

Notas

  • —ZeroGPU tiene un límite de tiempo por llamada a @spaces.GPU (por defecto unos 60-120s según cuota); generaciones muy largas pueden cortarse. Si lo notas, baja MAX_NEW_TOKENS.
  • —El primer request tras cada "cold start" del Space tarda más porque hay que cargar el modelo completo (27B en bf16 ≈ 54GB de VRAM — cabe holgado en la H200 de ZeroGPU).