CoolFace
Datasetpublic

ThunderstormXXL/deepscaler-teacher-sft-vllm-official-40k-clean-v4-conceptual

deepscaler-teacher-sft-vllm-official-40k-clean-v4-conceptual Filtered version of ThunderstormXXL/deepscaler-teacher-sft-vllm-official-40k. Filtering reward filter enabled: False minimum official reward: 1.0 scoring errors rejected: False maximum text tokens: 32768 maximum response chars: 200000 near-duplicate SimHash hamming threshold: 4 required <think>...</think> and final boxed answer after reasoning exact text/problem/response dedupe and near problem dedupe… See the full description on the dataset page: https://huggingface.co/datasets/ThunderstormXXL/deepscaler-teacher-sft-vllm-official-40k-clean-v4-conceptual.

sourceHugging Faceapache-2.0updated 4mo agoView on Hugging Face
1likes22downloads
Dataset Card

deepscaler-teacher-sft-vllm-official-40k-clean-v4-conceptual

Filtered version of ThunderstormXXL/deepscaler-teacher-sft-vllm-official-40k.

Filtering

  • —reward filter enabled: False
  • —minimum official reward: 1.0
  • —scoring errors rejected: False
  • —maximum text tokens: 32768
  • —maximum response chars: 200000
  • —near-duplicate SimHash hamming threshold: 4
  • —required <think>...</think> and final boxed answer after reasoning
  • —exact text/problem/response dedupe and near problem dedupe

Counts

  • —raw examples: 40300
  • —kept examples: 35632
  • —train examples: 34919
  • —val examples: 713
  • —keep rate: 0.8842

See summary.json and audit_rejected.jsonl for details.