interleaved-thinking
exp_tas_interleaved_thinking_on_tracesDCAgent2_terminal_bench_2_laion_exp_tas_interleaved_thinking_on_traces_20260102_050258qwen3-0.6B-interleaved-thinking-data
Qwen3 0.6B Interleaved Thinking Data
This dataset contains 8,704 pretraining-style text chunks augmented with short interleaved teacher thoughts. It was built for the blog post Self-Improving Pretraining as a Substrate for Agentic Post-Training.
The dataset turns ordinary pretraining text into the supervised stage of a thinking mid-training pipeline. A teacher inserts short local thoughts into raw FineWeb-Edu chunks while preserving the original text. The student then learns the… See the full description on the dataset page: https://huggingface.co/datasets/Jarrodbarnes/qwen3-0.6B-interleaved-thinking-data.DCAgent2_bfcl-parity_laion_exp_tas_interleaved_thinking_on_traces_20260226_005613dev_set_v2_exp_tas_interleaved_thinking_on_traces_20260317_060628DCAgent_dev_set_71_tasks_laion_exp_tas_interleaved_thinking_on_traces_20260102_073726
