mikelalda/Qwen3.8-27B_euskara
0
Qwen Euskara (ZeroGPU)
Chat con el modelo mikelalda/qwen3.8-27b_euskara (safetensors, vía transformers) corriendo sobre ZeroGPU — la GPU compartida y gratuita de Hugging Face Spaces (H200, asignada dinámicamente solo durante cada generación).
Paso obligatorio tras crear el Space
El SDK Gradio por sí solo no activa ZeroGPU. Después de subir estos archivos:
- Ve a Settings del Space.
- En Hardware, elige ZeroGPU.
- Guarda — el Space se reconstruye con acceso a ZeroGPU.
Sin este paso, import spaces seguirá funcionando pero las llamadas @spaces.GPU no tendrán GPU real que asignar y fallarán o irán a CPU.
Variables de entorno (opcionales)
Notas
- ZeroGPU tiene un límite de tiempo por llamada a
@spaces.GPU(por defecto unos 60-120s según cuota); generaciones muy largas pueden cortarse. Si lo notas, bajaMAX_NEW_TOKENS. - El primer request tras cada "cold start" del Space tarda más porque hay que cargar el modelo completo (27B en bf16 ≈ 54GB de VRAM — cabe holgado en la H200 de ZeroGPU).
