fan-shu/swe-mt-combined-hero-lego-nex-swezero
fan-shu/swe-mt-combined-hero-lego-nex-swezero Concatenated mid-train dataset for Qwen3 Thinking SFT. Each source subset is loaded in order and concatenated into a single config so one training epoch visits every trajectory exactly once (no interleave / no oversampling). Built from fan-shu/swe-instruct-trajectories-empty-think-inserted. Source subsets (6) nvidia__SWE-Zero-openhands-trajectories nex-agi__agent-sft nvidia__SWE-Hero-openhands-trajectories… See the full description on the dataset page: https://huggingface.co/datasets/fan-shu/swe-mt-combined-hero-lego-nex-swezero.
fan-shu/swe-mt-combined-hero-lego-nex-swezero
Concatenated mid-train dataset for Qwen3 Thinking SFT. Each source subset is loaded in order and concatenated into a single config so one training epoch visits every trajectory exactly once (no interleave / no oversampling).
Built from fan-shu/swe-instruct-trajectories-empty-think-inserted.
Source subsets (6)
nvidia__SWE-Zero-openhands-trajectoriesnex-agi__agent-sftnvidia__SWE-Hero-openhands-trajectoriesKwai-Klear__SWE-smith-mini_swe_agent_plus-trajectories-66k__Qwen3.6-27BSWE-Lego__SWE-Lego-Real-Data__Qwen3.6-27BSWE-Lego__SWE-Lego-Synthetic-Data__Qwen3.6-27B
Rows
415,736 total (train split)
Load
from datasets import load_dataset
ds = load_dataset("fan-shu/swe-mt-combined-hero-lego-nex-swezero", split="train")