CoolFace
Datasetpublic

costadev00/smoke-gemma4-matrix-brasil-25-v3-20260724-09

Smoke Gemma 4 — matriz de 25 tasks sobre Brasil Run real de validação do fluxo matricial document_task_matrix, executada sobre o documento Brasil da Wikipédia em português. Resultado status: completed documentos: 1 pares planejados: 25 exemplos aceitos: 25 pares pulados: 0 pares esgotados: 0 chamadas reais: 27 backend: vllm_local modelo: google/gemma-4-31B-it-qat-w4a16-ct As 25 tasks canônicas foram executadas uma vez cada. Todos os slots terminaram aceitos;… See the full description on the dataset page: https://huggingface.co/datasets/costadev00/smoke-gemma4-matrix-brasil-25-v3-20260724-09.

sourceHugging Faceupdated 2mo agoView on Hugging Face
0likes14downloads
Dataset Card

Smoke Gemma 4 — matriz de 25 tasks sobre Brasil

Run real de validação do fluxo matricial document_task_matrix, executada sobre o documento Brasil da Wikipédia em português.

Resultado

  • —status: completed
  • —documentos: 1
  • —pares planejados: 25
  • —exemplos aceitos: 25
  • —pares pulados: 0
  • —pares esgotados: 0
  • —chamadas reais: 27
  • —backend: vllm_local
  • —modelo: google/gemma-4-31B-it-qat-w4a16-ct

As 25 tasks canônicas foram executadas uma vez cada. Todos os slots terminaram aceitos; duas retentativas foram necessárias. A verificação final confirmou os contratos de saída, as três roles system/user/assistant e a ausência de truncamento do documento.

Ambiente de geração

  • —4 GPUs NVIDIA RTX 4000 Ada Generation
  • —tensor_parallel_size=4
  • —quantization=compressed-tensors
  • —kv_cache_dtype=fp8
  • —janela do modelo: 262.144 tokens
  • —orçamento de entrada: 258.048 tokens
  • —concorrência: 1

Conteúdo

  • —plan.json: plano v3 e lista canônica das tasks
  • —run.db: slots, tentativas, requisições e respostas
  • —report.json: resultado agregado da execução
  • —config.resolved.json: configuração efetivamente utilizada
  • —corpus-selected/: documento selecionado
  • —exports/messages/: dataset conversacional com três roles
  • —exports/prompt_completion/: formato prompt/completion
  • —exports/alpaca/: formato Alpaca
  • —exports/generation_info.json: proveniência da geração

Os dados são uma geração sintética destinada à validação técnica do pipeline.