fabricioslv/erika-bion-qwen08b-cpu
0
Erika Bion Qwen 0.8B CPU
Space CPU básico (free tier) rodando Qwen3.5-0.8B Q4_K_M via llama.cpp.
Função
- Inferência rápida e barata para tarefas Bionianas curtas: simbolização β→α, micro-narrativas, fallback de spaces maiores.
- Latência-alvo: < 30 s por chamada em CPU free (após cold-start).
Endpoints Gradio
chat_api— chat simples com state/history.bion_symbolize— transformaraw_data+emotional_chargeem α-element textual.health/inter_space_status— para pool dispatcher.
Modelo
unsloth/Qwen3.5-0.8B-GGUFQwen3.5-0.8B-Q4_K_M.gguf- Contexto 4096, 2 threads, 1 slot.
Uso no OmniMind
Roteado por src/erika/erika_space_client.py como fallback leve para:
bion_alpha_function/BionAsyncSymbolizer- tarefas com
max_tokens <= 256e baixa latência
