ThunderstormXXL/deepscaler-teacher-sft-vllm-official-40k-clean-v3-no-reward-filter
deepscaler-teacher-sft-vllm-official-40k-clean-v3-no-reward-filter Filtered version of ThunderstormXXL/deepscaler-teacher-sft-vllm-official-40k. Filtering reward filter enabled: False minimum official reward: 1.0 scoring errors rejected: False maximum text tokens: 8192 maximum response chars: 65000 near-duplicate SimHash hamming threshold: 4 required <think>...</think> and final boxed answer after reasoning exact text/problem/response dedupe and near problem… See the full description on the dataset page: https://huggingface.co/datasets/ThunderstormXXL/deepscaler-teacher-sft-vllm-official-40k-clean-v3-no-reward-filter.
deepscaler-teacher-sft-vllm-official-40k-clean-v3-no-reward-filter
Filtered version of ThunderstormXXL/deepscaler-teacher-sft-vllm-official-40k.
Filtering
- reward filter enabled:
False - minimum official reward:
1.0 - scoring errors rejected:
False - maximum text tokens:
8192 - maximum response chars:
65000 - near-duplicate SimHash hamming threshold:
4 - required
<think>...</think>and final boxed answer after reasoning - exact text/problem/response dedupe and near problem dedupe
Counts
- raw examples:
40300 - kept examples:
29361 - train examples:
28774 - val examples:
587 - keep rate:
0.7286
See summary.json and audit_rejected.jsonl for details.
