laion/swesmith_8b-step35
011
swesmith_8b-step35
RL-trained Qwen3-8B on SWEsmith tasks (32k context, no rope scaling, 35 steps).
Training Details
Usage
from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained("laion/swesmith_8b-step35")
tokenizer = AutoTokenizer.from_pretrained("laion/swesmith_8b-step35")