CoolFace
Apppublic

fabricioslv/erika-bion-qwen08b-cpu

sourceHugging Faceupdated 1mo agoView on Hugging Face
0likes
App README

Erika Bion Qwen 0.8B CPU

Space CPU básico (free tier) rodando Qwen3.5-0.8B Q4_K_M via llama.cpp.

Função

  • —Inferência rápida e barata para tarefas Bionianas curtas: simbolização β→α, micro-narrativas, fallback de spaces maiores.
  • —Latência-alvo: < 30 s por chamada em CPU free (após cold-start).

Endpoints Gradio

  • —chat_api — chat simples com state/history.
  • —bion_symbolize — transforma raw_data + emotional_charge em α-element textual.
  • —health / inter_space_status — para pool dispatcher.

Modelo

  • —unsloth/Qwen3.5-0.8B-GGUF Qwen3.5-0.8B-Q4_K_M.gguf
  • —Contexto 4096, 2 threads, 1 slot.

Uso no OmniMind

Roteado por src/erika/erika_space_client.py como fallback leve para:

  • —bion_alpha_function / BionAsyncSymbolizer
  • —tarefas com max_tokens <= 256 e baixa latência