CoolFace
Apppublic

scursel/qwen38-27b-obliterated

sourceHugging Faceapache-2.0updated 1mo agoView on Hugging Face
0likes
App README

Qwen3.8-27B OBLITERATED — Research Chat

Demo Gradio para o modelo OBLITERATUS/Qwen3.8-27B-OBLITERATED.

Arquitetura

  • —Gradio 6.25.0;
  • —ZeroGPU (zero-a10g), com quantização 4-bit NF4 via bitsandbytes;
  • —hardware selecionado no próprio Space, além da sugestão registrada no card;
  • —attn_implementation="sdpa", compatível com a GPU Blackwell do ZeroGPU;
  • —streaming de tokens com TextIteratorStreamer;
  • —modo de raciocínio opcional;
  • —interface responsiva personalizada, com tema técnico escuro e controles avançados recolhidos;
  • —histórico limitado às últimas 20 mensagens para evitar crescimento indefinido do prompt.

API e MCP

O Space expõe o modelo de duas formas: a API HTTP do Gradio e um servidor MCP compatível com clientes como Claude, Cursor, Cline e Windsurf.

Servidor MCP

Endpoint MCP via Streamable HTTP:

text
https://scursel-qwen38-27b-obliterated.hf.space/gradio_api/mcp/

No Claude Code:

bash
claude mcp add --transport http qwen-obliterated \\
  https://scursel-qwen38-27b-obliterated.hf.space/gradio_api/mcp/

No Cursor, adicione a entrada abaixo ao arquivo ~/.cursor/mcp.json:

json
{
  "mcpServers": {
    "qwen-obliterated": {
      "url": "https://scursel-qwen38-27b-obliterated.hf.space/gradio_api/mcp/"
    }
  }
}

As ferramentas MCP publicadas são mcp_chat (resposta completa, sem estado) e qwen38_27b_obliterated_demo_chat (chat com streaming). Para integrações MCP, prefira mcp_chat.

mcp_chat aceita:

  • —message — obrigatório;
  • —system_prompt — opcional;
  • —max_new_tokens — opcional, padrão 2048;
  • —enable_thinking — opcional, padrão false.

A ferramenta de chat com streaming qwen38_27b_obliterated_demo_chat aceita:

  • —message — obrigatório;
  • —system_prompt — opcional;
  • —max_new_tokens — opcional, padrão 2048;
  • —enable_thinking — opcional, padrão false.

API HTTP do Gradio

Descubra o contrato atual em:

text
https://scursel-qwen38-27b-obliterated.hf.space/gradio_api/info

Para iniciar uma chamada:

bash
curl -X POST \\
  https://scursel-qwen38-27b-obliterated.hf.space/gradio_api/call/chat \\
  -H 'Content-Type: application/json' \\
  -d '{
    "data": [
      "Explique computação quântica em termos simples.",
      "",
      2048,
      false
    ]
  }'

A resposta inicial contém um event_id. Consulte os eventos e o resultado final com:

bash
curl -N \\
  https://scursel-qwen38-27b-obliterated.hf.space/gradio_api/call/chat/{event_id}

A resposta é enviada como Server-Sent Events (generating durante o streaming e complete ao finalizar). Clientes Python e JavaScript também podem usar gradio_client; consulte o endpoint /gradio_api/info para obter exemplos gerados automaticamente.

Configuração de geração

Os valores seguem o model card:

ParâmetroValor
DecodificaçãoGreedy (do_sample=False)
Repetition penalty1.15
Máximo padrão2048 tokens
System promptVazio por padrão
Thinking modeDesligado por padrão

Contexto de segurança

Este é um modelo de pesquisa com mecanismos de recusa removidos dos pesos. O Space não deve ser usado para causar dano, violar direitos, obter acesso não autorizado ou produzir conteúdo ilícito. O usuário é responsável pelo uso e pelo conteúdo gerado.

Licença

O model card informa licença Apache-2.0. Consulte o repositório do modelo e os termos aplicáveis antes de publicar o Space.