CoolFace
Datasetpublic

fan-shu/swe-mt-combined-hero-lego-nex-swezero

fan-shu/swe-mt-combined-hero-lego-nex-swezero Concatenated mid-train dataset for Qwen3 Thinking SFT. Each source subset is loaded in order and concatenated into a single config so one training epoch visits every trajectory exactly once (no interleave / no oversampling). Built from fan-shu/swe-instruct-trajectories-empty-think-inserted. Source subsets (6) nvidia__SWE-Zero-openhands-trajectories nex-agi__agent-sft nvidia__SWE-Hero-openhands-trajectories… See the full description on the dataset page: https://huggingface.co/datasets/fan-shu/swe-mt-combined-hero-lego-nex-swezero.

sourceHugging Faceupdated 3mo agoView on Hugging Face
0likes216downloads
Dataset Card

fan-shu/swe-mt-combined-hero-lego-nex-swezero

Concatenated mid-train dataset for Qwen3 Thinking SFT. Each source subset is loaded in order and concatenated into a single config so one training epoch visits every trajectory exactly once (no interleave / no oversampling).

Built from fan-shu/swe-instruct-trajectories-empty-think-inserted.

Source subsets (6)

  • —nvidia__SWE-Zero-openhands-trajectories
  • —nex-agi__agent-sft
  • —nvidia__SWE-Hero-openhands-trajectories
  • —Kwai-Klear__SWE-smith-mini_swe_agent_plus-trajectories-66k__Qwen3.6-27B
  • —SWE-Lego__SWE-Lego-Real-Data__Qwen3.6-27B
  • —SWE-Lego__SWE-Lego-Synthetic-Data__Qwen3.6-27B

Rows

415,736 total (train split)

Load

python
from datasets import load_dataset

ds = load_dataset("fan-shu/swe-mt-combined-hero-lego-nex-swezero", split="train")